Обновить

Моя лента

Тип публикации
Порог рейтинга
Уровень сложности
Предупреждение
Войдите или зарегистрируйтесь, чтобы настроить фильтры
Статья

Путь к ИИ-сингулярности

Уровень сложностиПростой
Время на прочтение13 мин
Охват и читатели0

У нас было два репозитория неоттестированного вайб-кода, семьдесят пять тяжеловесных SDD-спецификаций, пять обмазанных смазкой харнессов, солонка, наполовину полная кастомных скиллов и забитых капслоком правил, с десяток дырявых MCP-серверов, RAG-база со свежевекторизованным Confluence, самодельная дощечка имаго-кодинга и целая россыпь автономных агентов всех мастей, от безобидных автодополнялок до галлюцинирующих субагентов, ставящих пакеты со slopsquatting и втихаря сносящих боевые базы.

Не то чтобы все это было действительно нужно для поездки к ИИ-сингулярности, но если уж начали участвовать в спуске с горы на велосипеде без седла, остановиться уже невозможно.

Единственное, что вызывало у меня настоящий животный страх, это передача ответственности за ревью самой модели. Тот самый момент, когда седьмой агент подтверждает галлюцинации шестого, потому что все тесты зеленые, и я знал, что рано или поздно мы перейдем на эту дрянь.

Нет ничего более беспомощного, безответственного и испорченного, чем IT-команда, запустившая мультиагентный оркестр в режиме allow all.

Это критический (и слегка ехидный) обзор того, что произошло с разработкой последние пару лет.

Читать далее

Новости

Статья

Coyote Time или как немножко врать игрокам

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели791

Есть довольно интересная категория багов в играх, которые формально багами являются, но игрокам они нравятся, и они, наоборот, называют багом “нормальное поведение” и строчат про него репорты про криворуких погромистов. Там, где программист хорошо и физически корректно сделал свою работу, игрок видит ошибку своего восприятия игры, не физики, а именно восприятия.

Представьте самый обычный платформер, в котором персонаж бежит по платформе, приближается к краю и должен прыгнуть на следующую. Если вы сделаете правильную обработку прыжка в этом месте в стиле “персонаж стоит на земле - можно прыгать, персонаж на земле не стоит - прыгать нельзя”: if (IsGrounded() && JumpPressed()) then Jump(), то c точки зрения “корректной” физики здесь будет не к чему придраться, потому что если под ногами уже нет платформы и было бы довольно странно сообщать персонажу, что он всё ещё находится на земле.

А если кнопка прыжка была нажата после того, как система коллизий говорит нам о потере контакта с поверхностью, то прыжок должен быть запрещён. Про такую логику можно даже сказать, что она ведёт себя “физически корректно”, но потом приходит тестировщик и говорит: “Ребят, прыжок какой-то странный. Я чувствую, что стою на земле, но прыжка нет”.

Вот это “чувствую” происходит из человеческого опыта, когда глаза у нас немного впереди, а пятки немного сзади и весь ваш предыдущий опыт говорит, что прыгнуть ещё можно. На самом деле нет, прыгнуть нельзя, стоя пятками на самом краю платформы прыгнуть вы не сможете, если вы, конечно, не Дрейк или Джеки Чан, ваш мозг просто компенсирует вашу позицию, относительно места прыжка, немного вам подвирая.

Читать далее
Новость

Разработчик выпустил Taiga‑S1 — компактную модель с 1,2 млн параметров для управления FreeCAD

Время на прочтение2 мин
Охват и читатели1.1K

Разработчик Шив Шанмугам (Shiv Shanmugam) представил Taiga‑S1 — компактную модель с 1,2 млн параметров, которая может создавать 3D‑детали во FreeCAD. Нейросеть принимает решения примерно за 1 мс. При этом ей не нужны LLM, скриншоты интерфейса и компьютерное зрение.

Читать далее
Новость

Delta Intelligence представила Δ₀ — модель для человекоподобных роботов, которая управляет всем телом

Время на прочтение2 мин
Охват и читатели1.4K

Китайская компания Delta Intelligence представила Δ₀ (Delta-0) — базовую модель для человекоподобных роботов, которая одновременно управляет движением, балансом и манипуляциями с предметами. В демонстрации робот на базе Δ₀ самостоятельно застилает кровать, поднимает предметы с пола, нажимает ногой педаль мусорного ведра, ставит пластинку на проигрыватель и садится на диван.

Читать далее
Статья

Решение задачи про козу, капусту и волка через конечный автомат

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели2.4K

Есть река и надо перевести на другой берег козу, капусту и волка. В лодку помещается только крестьянин и что-то одно из груза: капуста, волк или коза. Если на одном берегу без присмотра крестьянина оставить козу и капусту, то коза съест капусту. Если оставить волка и козу, то волк съест козу. Как перевести груз без потерь?

Я представил формальное решение на основе конечного автомата.

Читать далее
Новость

Исследователи представили ткань, которая охлаждает на солнце и вырабатывает электричество от движений

Время на прочтение2 мин
Охват и читатели1.8K

Исследователи из Университета Иллинойса в Урбане‑Шампейне (США) представили 3D‑печатный материал для «умной» одежды, совмещающий пассивное охлаждение и генерацию электричества от движений человека.

Читать далее
Статья

Локальный ассистент для зумов, часть 8: модель, ради которой я поменял диаризацию за один вечер

Уровень сложностиСредний
Время на прочтение4 мин
Охват и читатели2.1K

В третьей части я написал, что не вижу чужой модели, ради которой стоит менять связку. sherpa-onnx на диаризации, свой второй проход поверх, канал собеседников двадцатиминутного звонка размечается минут семь. Жить можно.

23 сентября NVIDIA выложила Nemotron 3 Diarization. Вечером 28-го я включил её в разбор своих созвонов. Тот же канал — три секунды.

Читать далее
Статья

Переход на Java 27: гайд по GC, флагам и памяти в контейнере

Уровень сложностиСложный
Время на прочтение14 мин
Охват и читатели2.3K

Переход на новый JDK может изменить поведение сервиса даже без изменений в коде: JVM по-другому выбирает GC, расходует память и обрабатывает старые флаги запуска.

В статье разбираем, что меняет Java 27 внутри рантайма и как проверить готовность сервисов к обновлению.

Изучить изменения
Новость

Anthropic выкатила Claude Sonnet 5.5: на 30% быстрее и дешевле. Что изменилось?

Время на прочтение2 мин
Охват и читатели2.8K

Компания Anthropic анонсировала выпуск второй модели в поколении 5.5 — Claude Sonnet 5.5.

В то время как большие языковые модели часто наращивают параметры в ущерб скорости, Anthropic пошли по пути оптимизации инференса. Модель не просто улучшила показатели в бенчмарках, но и стала дешевле в реальном использовании за счет алгоритмической экономии токенов.

Семейство Sonnet позиционируется как «золотая середина» между тяжеловесным Opus и легковесным Haiku.

Читать далее
Пост

Почему LLM ошибаются в простой математике

Языковая модель сама по себе не является калькулятором: она вероятностно предсказывает следующий токен, а не выполняет детерминированный алгоритм вычисления.

Для текста это полезное свойство — одну мысль можно выразить множеством способов. В математике «почти правильный» ответ уже неверен. В многошаговой задаче одна ошибка в промежуточном значении распространяется на весь результат.

Практический вывод для ИИ-агентов: разделять роли. LLM должна понять задачу, составить план и выбрать инструмент. Сам расчёт лучше передать калькулятору, Python, CAS или специализированному вычислителю, а затем проверить и объяснить ответ.

Сильная агентная система — это не только модель, но и правила использования инструментов.

Подробнее — в моём Telegram-канале «Идеи для ИИ — Андрей Анисимов». Ссылка в профиле.

Теги:
0
Комментарии2
Новость

Amazon планирует запустить доставку дронами в Австралии

Время на прочтение1 мин
Охват и читатели2.4K

Amazon готовится запустить доставку дронами в Австралии. Компания уже ищет представителя для переговоров с австралийскими регуляторами для получения соответствующих разрешений.

Читать далее
Новость

Anthropic выпустила Claude Sonnet 5.5: модель на 30% быстрее и экономнее Sonnet 5

Время на прочтение2 мин
Охват и читатели2.6K

Основной апгрейд пришёлся на агентное программирование, длинные задачи и повседневную работу с документами, таблицами и презентациями.

По данным Anthropic, Sonnet 5.5 генерирует ответы 30 с лишним процентов быстрее Sonnet 5. При этом цена токенов осталась прежней, но сама задача обычно обходится дешевле: модель тратит меньше токенов и делает меньше шагов. В тестах Anthropic экономия достигала 30% на задачу.

Читать далее
Новость

Китайский учёный представил рюкзак, который умеет делать массаж спины

Время на прочтение1 мин
Охват и читатели3.9K

Исследователь Чэнсун Юй из Уханьского технологического института в Китае представил рюкзак, который распознаёт усталость мышц и автоматически массирует их. Автор утверждает, что такой подход способствует восстановлению мышц эффективнее, чем тепловой компресс или стандартный автоматический массаж (такой, как в массажных креслах).

Технология анализирует электрические сигналы мышц и направляет массажный ролик к перегруженному участку. Данные с датчиков позволяют системе непрерывно регулировать интенсивность воздействия в зависимости от степени усталости, поясняет Юй.

Читать далее

Ближайшие события

Статья

Pillow для обработки изображений: все фильтры от А до Я

Время на прочтение8 мин
Охват и читатели4.8K

Это вторая часть разбора библиотеки Python Pillow. В прошлой статье был сделан упор на общее направление и примеры, теперь же давайте разберём конкретный инструментарий: отвечу на вопросы, что вообще можно использовать и каким образом. Можно назвать это так: прошлая статья – введение в ремонт, эта – хранилище инструментов. Стоит учесть, что всю более подробную информацию можно найти в сети, а с целями (зачем, для чего) придётся определяться самим. Впрочем, это и так очевидно.

Вся суть, благодаря которой нога моя ступила на территорию Pillow, можно описать следующим образом: желание автоматизации однотипной обработки нескольких файлов подряд. Через Photoshop можно обработать одно фото, но если у вас есть определённый шаблон, придётся долго возиться с каждым отдельным изображением. Нужен был инструмент, который был бы достаточно гибким, чтобы при желании и менять параметры, и создавать из последовательностей – функции. Таким инструментом оказалась библиотека Python, форк PIL, – Python Pillow.

Как и в программах для редактирования визуальных объектов данная библиотека работает по принципу фильтров: есть определённые фильтры, которые делают что-то с изображением, и можно задать определённое значение таким образом, чтобы указать программе, насколько сильно стоит это применить. И да, абсолютно весь тот шикарный визуал, который вы когда-либо видели в сети, был обработан, описан и создан именно по такой цепочке: ввод, наложение некоторых фильтров в каком-то соотношении, вывод.

Разобьём инструментарий на типы: равно как и отвёртки лежат отдельно от болтов... В Pillow есть три типа фильтров: готовые пресеты (те, что не требуют указания дополнительных значений), регулируемые фильтры (те, что требуют указания), и «ImageEnhance» (для регуляции контраста, яркости, резкости). Первые два типа объединены в единое семейство: «ImageFilter». Рассмотрим сначала их.

Читать далее
Статья

Modus Operandi, или почему ваши сотрудники ведут себя как робот‑пылесос…

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели4K

Многие руководители и предприниматели спрашивают: «Почему мои сотрудники инфантильны и я вынужден по пятьдесят раз объяснять, что от них требуется? Почему не берут на себя ответственность и прячут голову в песок? Проще сделать самому...».

Читать далее
Статья

Музыка для кода — что наука говорит о влиянии Lo‑Fi, чиптюна и саундтреков из игр на продуктивность

Время на прочтение9 мин
Охват и читатели4.5K

Говорят, классическая музыка буквально творит чудеса — заставляет мозг работать быстрее, поднимает иммунитет и чуть ли не развивает интеллект ребенка до 146 пунктов еще в утробе матери. И если нужно написать сложный алгоритм или спроектировать архитектуру, стоит обратить внимание на Баха или Моцарта, ведь классика — это сплошная математика.

Иронично, но нередко «эффект Моцарта» оказывается не более чем популяризаторским мифом. Особенно, если мы говорим про сложные интеллектуальные задачи — например, кодинг. А вот Lo-Fi, 8-битный чиптюн и саундтреки к видеоиграм могут наоборот помочь. В этой статье мы разберем, почему «низкотехнологичная», а то и вовсе прикладная музыка справляется с ролью рабочего фона намного лучше классики. 

Читать далее
Новость

Microsoft уберёт Copilot из списка чатов Teams

Время на прочтение2 мин
Охват и читатели3.5K

Microsoft уберёт Copilot из списка чатов Teams. Как поясняют в компании, это будет сделано для упрощения доступа к ИИ‑помощнику и разгрузки интерфейса.

Сейчас Copilot доступен в Teams через список чатов или через панель приложений слева. В переходный период Microsoft добавит подсказку, которая будет направлять пользователей от списка чатов к приложению Copilot на левой панели. Если пользователь ранее открепил Copilot от боковой панели, подсказка объяснит, как запустить его через меню дополнительных приложений.

Читать далее
Новость

Исследование: даже очень медленный бег полезен для мозга

Время на прочтение3 мин
Охват и читатели5K

В некоторые дни бывает сложно найти в себе силы для тренировки. Каждый из нас когда‑нибудь бегал очень медленно, чуть быстрое ходьбы. Возможно, в такой момент кажется, что всё это бессмысленно, однако новое исследование предполагает, что даже пробежки, почти не требующие усилий, всё равно могут приносить пользу. Исследование показывает, что бег даже на самой низкой скорости способен улучшать настроение и исполнительные функции префронтальной коры мозга.

Исследователи из Университета Цукубы в Японии провели эксперимент с участием 24 здоровых молодых взрослых. Каждый из участников в течение 10 минут бежал на беговой дорожке в медленном темпе, примерно от 3 до 6 километров в час. По сравнению с днём, когда участники 10 минут просто сидели, после десятиминутной пробежки они сообщали о значительном улучшении настроения, в том числе о большей бодрости и более приятных ощущениях. После пробежки также улучшилось время реакции в тесте на внимание и самоконтроль по сравнению с сидячим отдыхом.

Во время этих когнитивных тестов участники носили специальные устройства, измерявшие изменения уровня оксигенированного гемоглобина у поверхности мозга. После пробежки эти устройства во время когнитивных тестов регистрировали более сильный сигнал насыщенной кислородом крови в двух областях левой префронтальной коры.

Новый эксперимент предполагает, что когнитивные и нейронные преимущества бега необязательно ограничиваются более интенсивными упражнениями. Результаты пока предварительные: исследование не сравнивало ходьбу с бегом и не изучало долгосрочные эффекты. Однако они позволяют предположить, что очень медленный бег в краткосрочной перспективе положительно влияет как на исполнительные функции, так и на настроение.

Читать далее
Новость

Kuaishou анонсировала Kling 4.0 – модель выйдет в октябре

Время на прочтение2 мин
Охват и читатели4.3K

Китайский техногигант Kuaishou официально представил следующую итерацию своей модели для генерации видео — Kling 4.0. В условиях гонки с другими ИИ-видеогенераторами азиатские разработчики делают ставку на нативную генерация 30 секунд, 4K, липсинк и мультимодальный omni reference.

Публичный релиз модели намечен на следующий месяц, но архитектурные особенности и заявленные фичи уже вызывают интерес.

Читать далее
1
23 ...