Обновить

Моя лента

Тип публикации
Порог рейтинга
Уровень сложности
Предупреждение
Войдите или зарегистрируйтесь, чтобы настроить фильтры

Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM

Qwen3.8-Flash-Next - открытая 125B-модель на архитектуре, которая станет основой Qwen4. По опубликованным Qwen результатам она конкурирует с закрытыми frontier-моделями в задачах программирования, работы с агентами и computer use.

Мы запустили полный checkpoint Qwen/Qwen3.8-Flash-Next на одной RTX 4090. Пиковое потребление VRAM составило 5,95 ГБ, без 4-битной квантизации и дистилляции. Использовался полный checkpoint в bf16, который генерировал обычные токены.

По сравнению с Opus 4.6 Max, согласно собственным данным Qwen:

Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM
Статья

Сольные настольные игры и с чем их едят

Уровень сложностиПростой
Время на прочтение28 мин
Охват и читатели517

Вы хотели когда-нибудь поиграть, но при этом отдохнуть от ПК или консоли? Это статья для вас!
В этой статье я расскажу что такое настольные игры для одного игрока, как в них играть и что они из себя представляют.

Поиграть одному можно и не только в компик)

Читать далее

Новости

Статья

Простой тестер шторно‑щелевого затвора из фотодиодов BPW34, яркого фонарика и звуковой карты

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели846

Встала необходимость проверки затворов моих камер. Так как отправлять камеры к мастерам в другие города — дело долгое и заморочное, было решено собрать простой тестер из доступных деталей с маркетплейсов.

Прибор собран из трех фотодиодов BPW34, механического выключателя, резистора, микрофонного провода и напечатанного на 3D‑принтере корпуса (stl модели прилагаются). Фотодиоды расположены в линию со смещением к одному краю кадрового окна. Использование как одного так и всех трех датчиков позволяет оценить состояние затвора камеры, равномерность выдержек, равномерность экспонирования и провести настройку в домашних условиях.

Читать далее
Статья

Реклама на крышке MacBook за 1,5 млн рублей. Почему это сработало

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели2.2K

Марат Юсупов выставил на аукцион десять мест под наклейки на своём личном MacBook и заработал 1 472 784 рубля. Почти полтора миллиона за логотипы на крышке чужого ноутбука.

Самое странное здесь даже не цена. Идея была не новой: Марат, так сказать, вдохновился иностранным экспериментом Brand My Mac и адаптировал его для России, сделав первый успешный в стране подобный аукцион. А на сайте оригинала есть прекрасная оговорка: рекламодателю не гарантируют ни определённого количества показов, ни ROI.

Получается странная сделка. Бренды платят за рекламу, но заранее не знают, будет ли от этого хоть какой-то эффект.

Читать далее
Статья

Компьютеры для людей или люди для компьютеров?

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели2.2K

Компьютеры понемногу начинают понимать обычную человеческую речь. И даже писать программы сами для себя. Уйдет ли в прошлое профессия программиста? Даже в отдаленной перспективе вряд ли, потому что чтобы ИИ работал и развивался, кто-то должен его разрабатывать и поддерживать.

Навайбкодить
Статья

Ссылку засчитали, компанию не рекомендовали: как проверить видимость бренда в ответах ИИ

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели1.8K

В отчёте по видимости бренда в ответах ИИ компания нашлась по трём из двадцати вопросов. Открыли сами ответы — и оказалось, что за этим числом стоят разные вещи. В одном случае компанию предложили как исполнителя. В другом поставили ссылку на её статью, но назвали чужую компанию. В третьем название бренда уже было в вопросе.

Представим, что вы хотите попасть в список компаний, из которых выбирает клиент. В отчёте появляется плюс за ссылку на сайт. А в самом ответе заказчик читает о другом бренде. Если смотреть только на процент видимости, разницу можно пропустить.

Читать далее
Новость

Apple представила iPhone Duo — первый складной iPhone за $2000

Время на прочтение2 мин
Охват и читатели2.7K

Apple представила iPhone Duo — свой первый складной смартфон. Устройство выполнено в формате «книжки»: в сложенном виде пользователю доступен компактный iPhone с внешним 5,4-дюймовым экраном, а в разложенном — почти планшет с 7,6-дюймовым дисплеем. По габаритам раскрытый смартфон находится между обычным iPhone и iPad mini.

Читать далее
Новость

Исследователи смогли подслушать разговор по наушникам через бетонную стену

Время на прочтение3 мин
Охват и читатели3K

Исследователи из Гонконгского университета науки и технологий и Гонконгского политехнического университета показали новый способ электромагнитной атаки, позволяющий извлекать низкочастотные аналоговые сигналы из обычной электроники. Разработанный ими метод InjectEave в экспериментах позволил восстанавливать речь, воспроизводимую в проводных и беспроводных наушниках, в том числе через стену и на расстоянии до 30 метров.

Обычные атаки по электромагнитным побочным каналам основаны на том, что работа электронных схем неизбежно создаёт слабое электромагнитное излучение. Так раньше удавалось, например, восстанавливать изображение с дисплеев или регистрировать ввод с клавиатуры. Однако с аналоговыми сигналами вроде речи возникает проблема: их частоты слишком низки, чтобы проводники внутри устройства эффективно работали как непреднамеренные антенны. Поэтому такое излучение обычно сложно обнаружить на заметном расстоянии.

Авторы работы предложили не просто пассивно слушать устройство, а дополнительно облучать его высокочастотным электромагнитным сигналом. Нелинейные компоненты электроники, включая усилители, аналого‑цифровые преобразователи и преобразователи питания, смешивают внешний сигнал с внутренним. В результате низкочастотная информация оказывается «перенесена» на высокочастотную несущую, которая значительно лучше излучается наружу. После приёма её можно демодулировать и восстановить исходный сигнал.

Исследователи проверили подход на 11 серийных устройствах: проводных и беспроводных наушниках, настольном VoIP‑телефоне, умных вентиляторах и лампах. В лабораторных условиях речь из нескольких моделей наушников удавалось распознавать на расстоянии нескольких метров. В отдельном эксперименте более мощное оборудование увеличило дальность прослушивания до 30 метров. А в гостиничном номере и переговорной исследователи смогли восстановить речь из наушников, находясь за 30-сантиметровой бетонной стеной.

Читать далее
Статья

Компактная кросс‑платформенная open source C++ библиотека для разработки приложений с графическим интерфейсом — Frenchie

Уровень сложностиСредний
Время на прочтение18 мин
Охват и читатели2.9K

В этой статье я расскажу про возможности компактной кросс‑платформенной библиотеки с открытым исходным кодом для разработки приложений с графическим интерфейсом на языке C++ — Frenchie. Цель материала - познакомить читателей с возможностями библиотеки и сделать сравнение функционала с другими похожими проектами. Если кому-то интересна техническая сторона проекта, то предлагаю заглянуть в исходный код, либо в материалы, описывающие архитектурную и техническую часть.

Читать далее
Статья

А чё, так можно было? Недокументированный C#

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели3.5K

В C# есть четыре ключевых слова, которых нет в документации. Компилятор их принимает.

Одно из них собирается на любой машине, а выполняется только на Windows. На Linux та же сборка падает. Дальше — как объект меняет свой тип на ходу и что на самом деле происходит при вызове метода у пустой ссылки.

Читать далее
Пост

Парадокс Джевонса был сформулирован в 1800-х годах для объяснения динамики на угольном рынке.

Джевонс обнаружил, что технологические усовершенствования могут повысить эффективность использования ресурсов, но это часто приводит к увеличению общего потребления ресурсов. Повышение эффективности приводит к снижению эффективных издержек, а при снижении издержек спрос будет расти. 

Мы наблюдаем этот эффект во многих отраслях, переживающих технологические усовершенствования, но, пожалуй, лучше всего его иллюстрирует рынок искусственного интеллекта, где эффективность постоянно повышается, а спрос продолжает расти. Потребность в электроэнергии будет расти. Спрос на микросхемы будет расти. Спрос на данные будет расти. Да, эффективность повышается, но при этом увеличится и потребление основного продукта и сопутствующих материалов. 

В индустрии искусственного интеллекта нет ничего особенного. Она следует тому же принципу, который мы наблюдали бесчисленное количество раз на протяжении столетий. 

Хорошего дня! заходите на тг канал https://t.me/TradPhronesis

Теги:
-2
Комментарии0
Статья

Как выявлять саботаж стейкхолдеров в ИТ‑проектах и сохранить внедрение под контролем

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели3.3K

ИТ‑проект может остановиться задолго до технических проблем: сроки начинают плыть, согласования затягиваются, а пользователи формально участвуют в работе, но фактически блокируют изменения.

Разберём, как аналитики могут распознать признаки сопротивления, найти реальную причину конфликта и выстроить работу с ключевыми стейкхолдерами — от первого сигнала до выбора стратегии действий.

Разобрать кейсы
Статья

ИИ решил одну из математических «задач тысячелетия» с призом в $1 млн

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели4K

Утром во вторник, 8 сентября, математики из OpenAI объявили, что группа из 10 000 автономных ИИ‑агентов под их руководством, работавших на продвинутой модели, недоступной широкой публике, обнаружила «сингулярность» в трёхмерных уравнениях Навье — Стокса. Тем самым была решена одна из шести остававшихся нерешёнными задач тысячелетия, сформулированных в 2000 году Математическим институтом Клэя. За решение каждой из них назначена премия в $1 млн. Результат был формально проверен на языке программирования Lean, что даёт математикам основания считать его правильным.

Если результат выдержит дальнейшую проверку, то с большим отрывом станет самым важным математическим доказательством, полученным на сегодняшний день с помощью модели искусственного интеллекта. Возможно, он знаменует фундаментальный перелом в том, как математики будут подходить к сложным задачам.

Эта конкретная сложная задача касается дифференциальных уравнений, которые выражают взаимосвязи между изменяющимися величинами. Пожалуй, это важнейший математический инструмент для объяснения окружающего мира. Как правило, такие уравнения легко записать, но трудно решить.

Уравнения Навье — Стокса представляют собой дифференциальные уравнения, которые на основе второго закона Ньютона описывают поведение жидкостей и газов, от океанических течений до воздушных потоков. Впервые их записали в середине XIX века, и с тех пор они играют центральную роль в механике жидкости. Однако один фундаментальный вопрос об этих уравнениях оставался без ответа: всегда ли их решения ведут себя «хорошо»? Или со временем решение может эволюционировать таким образом, что какая‑то бесконечно малая часть жидкости начнёт двигаться с бесконечно большой скоростью, создавая так называемую сингулярность?

Читать далее
Статья

Положил http:// в строку, и ассемблер молча собрал 0 байт

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели3.2K

Мой ассемблер резал исходник построчными правилами: срезал комментарий, искал двоеточие, делил по запятым. Я заменил это одним проходом с состоянием и попутно проверил, нельзя ли было обойтись заплатками.
Нельзя: вторая заплатка ломает то, что починила первая.

Куда делись байты?

Ближайшие события

Статья

GPT Images 2.5: новая нейросеть для генерации изображений от OpenAI

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели3.9K

Как же за всем этим успевать?

За это время вышли ещё и обновлённый DeepSeek, и результаты по Навье-Стоксу. На этом фоне у GPT Images 2.5 были все шансы потеряться. Не потерялся.

Разве что реддит-модер ненадолго снёс официальный пост OpenAI из-за «вторника без картинок»...

Так вот, 8 сентября 2026 года OpenAI выпустила обновлённую версию своего генератора изображений – ChatGPT Images 2.5. Официально это не «тройка», хотя по объёму изменений можно было бы и замахнуться. Впрочем, это и в самом деле скорее «версия 2.0, доведённая до ума», чем революция. Но именно это доведение до ума и есть самое интересное.

Если в двух словах: генерация стала быстрее почти на 50%, редактирование – более хирургическим, а сама модель – заметно менее забывчивой в длинных диалогах. Дальше – details, details, details.

Спойлер: пеликана на этот анимировали в 96 кадрах и прокатили на велосипеде. Но обо всём по порядку.

Читать далее
Статья

ML System Design: Что на самом деле проверяют на собеседовании?

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели3.6K

Однажды я упустил огромный оффер в бигтех из-за того, что провалил собеседование по ML System Design. Возникает вопрос: как готовиться к прохождению такой секции, если в реальной работе задачи на проектирование встречаются не так часто?

Недавно я участвовал в ML Kata: 6 команд за 75 минут проектировали одну и ту же ML-систему — голосового агента для клиники. Я считаю, что проанализировав защиты команд и обратную связь от судей(одним из которых был Валерий Бабушкин), можно вкачать навык MLSD на уровень, достаточный для прохождения собеседования – при условии, что вы уже знаете метрики и модели для конкретной технической задачи. В этой статье я сделаю такой разбор за вас и систематизирую типовые ошибки участников, которых не смог избежать и сам.

Читать далее
Пост

Стартап российских математиков Mostik научил нейросети общаться между собой напрямую, без текста, чтобы объединять несколько моделей и экономить деньги на ресурсы и токены для ИИ. Стартапу всего четыре месяца. Его основала россиянка Александра Малышева, а в команде 15 человек, почти все с PhD и опытом работы в Google, Nvidia или Perplexity.

Точный механизм работы своего решения в Mostik не раскрывают. В теории это означает, что маленькую модель можно соединить с большой, чтобы повысить точность ответов у первой. Это должно сократить затраты на передачу данных от одной модели к другой.

Теги:
+3
Комментарии0
Статья

Я попробовал ужать LLaMA-7B до 1 ГБ без дообучения. Вот что произошло после 60+ экспериментов

Уровень сложностиСложный
Время на прочтение12 мин
Охват и читатели3.6K

В какой‑то момент я посмотрел на 13 ГБ весов LLaMA-7B и подумал: а почему, собственно, они должны занимать именно столько? Что, если не делать маленькую модель, не учить её заново и не заставлять копировать большую, а просто найти более короткую запись тех же «мозгов»?

Здравый человек, вероятно, скачал бы готовую квантизацию и пошёл заниматься своими делами. Я вместо этого поставил цель ужать модель сначала до 2 ГБ, а в идеале — до одного. Без дообучения, дистилляции, pruning и изменения архитектуры. Только математика над уже готовыми весами и небольшая выборка текстов для калибровки.

Так появился PCST — домашний исследовательский проект, который довольно быстро превратился в длинный сериал. В нём уже больше 60 проверенных методов, сотни конфигураций, несколько версий модели, один очень неприятный системный баг и приличная коллекция идей, которые выглядели прекрасно ровно до тех пор, пока я не запускал модель целиком.

Спойлер: одного гигабайта и качества Q8 я не получил. Текущий артефакт занимает 2.05 GiB и пока проигрывает обычной Q3_K_M и по качеству, и по скорости. Зато я наткнулся на вещь, которая оказалась интереснее очередной красивой цифры: можно заметно улучшить восстановление отдельных весов и одновременно сделать всю модель глупее.

Ниже — история о том, куда исчезают локальные улучшения, почему методы из картинок почти бесполезны для сырых весов и как одна ошибка с transpose заставила пересмотреть большую часть уже полученных результатов.

Читать далее
Статья

Внутренний вебхук исполнял любой SQL под суперюзером. Без пароля, без токена, без единого заголовка

Время на прочтение5 мин
Охват и читатели3.3K

30 августа делал security-ревью собственной инфраструктуры и решил проверить один служебный маршрут вручную, вместо того чтобы верить, что раз он «внутренний», значит закрыт. Обычный curl с ноутбука:

Читать далее
Новость

В Рунити аттестовали инфраструктуру по новым требованиям ФСТЭК для работы с ЕСИА

Время на прочтение1 мин
Охват и читатели4K

Мы получили аттестаты соответствия требованиям 117-го приказа ФСТЭК России для взаимодействия с ЕСИА при обслуживании доменов .ru, .рф и .su. С 1 сентября 2026 года вступили в силу новые правила регистрации доменов, а с 1 января 2027 года все российские регистраторы обязаны подтвердить соответствие стандартам безопасности по требованиям ФСТЭК.

Прохождение этой аттестация подтверждает, что инфраструктура наших регистраторов Руцентра и Рег.ру построена на отечественном сертифицированном ПО и защищена по актуальным регламентам (включая 149-ФЗ и ПП РФ №1119) для прохождения идентификации администраторов доменов через портал «Госуслуги».

Что изменилось технически: Приказ ФСТЭК №117 (вступил в силу с марта 2026 года) обязывает реализовать 17 групп мер защиты: от идентификации и управления доступом до защиты виртуализации, контейнеров, API, веб-сервисов и каналов связи. В связке с приказом ФСБ №117 (действует с апреля 2025 года) это требует применения сертифицированных СКЗИ. Совместно с интегратором «Лоджикал ИТ» мы в Руцентре и Рег.ру спроектировали новую ИС, перестроили инфраструктурный контур и доработали процессы эксплуатации, чтобы обеспечить легитимный защищенный обмен данными с госсервисами.

Что это значит для владельцев доменов: С 1 января 2027 года операторы, взаимодействующие с госсистемами, в том числе с ЕСИА, обязаны либо использовать типовое решение, либо пройти оценку влияния на СКЗИ в ФСБ. Это значит, что полученный аттестат гарантирует, что Руцентр и Рег.ру смогут быть включены в перечень регистраторов, а все операции с доменами в зонах .ru, .рф и .su пройдут без регуляторных рисков для администраторов доменов.

Читать далее
Статья

Системный анализ в большом банке: IBAN, миграция АБС и тысячи интеграций

Уровень сложностиПростой
Время на прочтение14 мин
Охват и читатели4K

Привет, Хабр! Я Елена Журавлева, системный аналитик в Т-Банке в команде импортозамещения АБС. Внедрять новые платежные методы в условиях санкций и одновременно менять ядро АБС — вызов для любой команды. Расскажу, как профессия стала инфраструктурой и как эта инфраструктура помогает аналитику менять проекты, не теряя в перформансе.

Моя история — часть проекта «20 в 20» в честь 20-летия компании: 20 специалистов из 20 городов делятся своими историями в серии статей, чтобы показать ИТ-хабы в разных городах и рассказать о людях, которые в них выросли.

Читать далее
1
23 ...