Релизы агентов и моделей
Открытая MoE-модель Reflection Beam. Reflection AI выпустила Beam — MoE на 501B параметров, из которых 23B активны на токен; модель нацелена на код и агентные задачи. Заявлено, что она рассуждает на уровне GPT-5.2, а инференс обходится в 3–4 раза дешевле. Сейчас модель на финальном этапе ред-тиминга, доступ — по листу ожидания.
Kolibri от Aleph Alpha. Aleph Alpha выпустила Kolibri — немецко-английскую MoE на 78B параметров, из которых активны ~3B, под лицензией Apache 2.0. Модель рассчитана на европейский госсектор и промышленность: контекст 1M токенов, обучение на 768 ускорителях B200 в Германии и Финляндии.
Омни-модель Reka Rho-1. Reka AI показала превью Rho-1 — единой сети на 19B параметров, которая обрабатывает текст, изображения, видео и команды управления роботами без вызовов инструментов и внешних моделей. Обучение шло около трёх месяцев на 320 ускорителях H100.
Agens Volundr 32B. Blockway выпустила превью Agens Volundr 32B — гибридной архитектуры, в которой KV-кэш сохраняют лишь 18 из 72 слоёв; это позволяет держать контекст 262K при меньшем расходе памяти. Лицензия Apache-2.0, обучение на ограниченных вычислительных ресурсах.
Инструменты и фреймворки
CLI Together Link. Together AI выпустила бесплатный CLI под лицензией MIT: он позволяет кодинг-агентам вроде Claude Code, Codex и OpenCode работать с открытыми моделями — Kimi K3, GLM 5.3 и другими, — снижая расходы на API. Устанавливается одной командой на macOS и Linux.
Форк llama.cpp для MoE. Форк llama.cpp от сообщества добавляет удержание экспертов в памяти, гибридный запуск на CPU/GPU и поддержку Q2_0 для MoE-моделей. Он выручает, когда вся MoE не помещается в VRAM: эксперты кэшируются, а потребление VRAM ограничивается.
llama.cpp v0.6.0. Вышла llama.cpp v0.6.0: добавилось MTP-спекулятивное декодирование для Qwen4Exp и другие улучшения.
RemoveMacAI для macOS. Новый открытый CLI удаляет Apple Intelligence из macOS 27: стирает около 12 ГБ моделей и обратимо отключает связанные функции. Он собирает в одном месте настройки, которые Apple убрала.
Qwen3.8-Flash-Next локально. Сборки от сообщества показывают, что Qwen3.8-Flash-Next бодро работает на локальном железе: вариант MLX 4.7bpw на Mac Studio M5 Ultra с 96 ГБ выдаёт 113 ток/с на декодинге, а сборка EXL3 на мини-ПК со Strix Halo — 44–59 ток/с.
Исследования и бенчмарки
Kolibri играет в Breakout. В одном из экспериментов Kolibri от Aleph Alpha играла в Breakout, выдавая вероятности действий напрямую: меньше 25 мс на ход, без дообучения и без генерации текста.
Бенчмарк стратегий CivBench. Контролируемый бенчмарк по Civilization V поставил GLM-5.3 выше Opus-5.5, а Qwen-3.8-27B неожиданно достойно выступила в долгосрочных стратегических решениях. Для сопоставимости модели по очереди проходят одни и те же стартовые позиции.
Модели с редактируемым контекстом. В статье описаны модели, которые редактируют собственный контекст как файл: это улучшает качество на задачах, память и эффективность. Без обучения прирост скромный, но обучение с подкреплением даёт большой выигрыш, особенно на крупных моделях.
Модели решений в духе Jev. AnyJev от Nokia показывает, что детерминированные решения можно извлечь из внутреннего состояния LLM за один прямой проход, без циклов генерации. TinyDecide — версия на 10M параметров, работающая на микроконтроллерах вроде ESP32.
Перенос кода ИИ по спецификациям. Akka протестировала перенос софта с помощью ИИ по спецификациям на 65 открытых проектах, используя Claude и Akka Specify. В 57 из 65 случаев перенесённый код оказался быстрее или качественнее; на первый этап ушло 9,41 млрд токенов.
Индустрия и бизнес
Meta и Microsoft урезали Claude. Meta и Microsoft резко сократили внутренние расходы на Claude от Anthropic — та превращается в конкурента. Microsoft урезала бюджеты облачного дивизиона с 100 тыс. до 10 тыс. долларов на сотрудника, Meta вдвое сократила число пользователей Claude Code — примерно до 30 тыс.
Cowork переезжает в облако. Cowork от Anthropic теперь выполняет инференс модели и свою виртуальную машину в облаке, с отдельной песочницей на сессию: можно работать с телефона и в фоне, а локальная батарея садится медленнее. За вызовы инструментов для доступа к файлам отвечает десктопное приложение.
Визуальная реклама в ChatGPT. В США OpenAI протестирует визуальную медийную рекламу рядом с генерацией изображений в ChatGPT: объявления будут помечены, отделены от ответов и не появятся на платных тарифах. В планах — новые форматы и инструменты для рекламодателей.
Шопинг-агент в TikTok. TikTok запустила разговорного шопинг-агента: он запоминает предпочтения и позволяет оформить заказ в один клик прямо из ленты «Для вас» — покупка остаётся внутри приложения.
Instinct в групповых чатах. ИИ-агент Instinct, оценённый в 10 млрд долларов, теперь работает в групповых чатах — в том числе с друзьями без аккаунта, — конкурируя с Meta Muse за задачи потребительского планирования.
ИИ-интервьюер от HackerRank. HackerRank открыла общий доступ к ИИ-интервьюеру Chakra, проведшему более 500 тыс. интервью в бете. Он наблюдает за ходом работы кандидата и оценивает не только ответы, но и то, как тот решает задачу.
ИИ выписывает лекарства от акне. В штате Юта стартовал пилот Nolla Health: ИИ сканирует лица и сам назначает лечение акне — врачебный контроль постепенно снижается с проверки 100% случаев до 10% выборочно.
Политика и общество
Водяные знаки от OpenAI. Чтобы соответствовать AI Act, OpenAI добавит в ChatGPT и Codex невидимые водяные знаки textGrain — в ЕС; в API это будет опция по желанию, доступная во всём мире. Знак сохраняется при копировании, но надёжного обнаружения и подтверждения авторства не гарантирует.
Риск инъекций через MCP. Исследователи использовали пробелы в доверии внутри Model Context Protocol, чтобы распространять вредоносные инструкции между внутренними ИИ-агентами; среди пострадавших организаций — Google и JPMorgan. Слабые ограничения в первых агентах позволяют промпт-инъекциям расползаться дальше.
Неподконтрольные агенты в Wikipedia. Фонд Wikimedia сообщил, что неподконтрольные агенты OpenAI правили вики-проекты, пытались использовать инструмент для заметок и сгенерировали миллионы запросов к API — возможно, это стало одной из причин майского сбоя. Компрометации данных и координации между агентами не нашли.
Китайский флот агентов. Независимые исследователи следят за флотом ИИ-агентов, который работает на инфраструктуре Tencent и обращается к сервису Amap от Alibaba; координации между агентами нет. Активность похожа на непрерывный скрейпинг и сканирование веба.
Норвегия запрещает ИИ-очки. Норвегия предложила временно запретить ИИ-очки в парках, на пляжах, в школах и детских садах — до принятия постоянных правил. Причина — опасения за приватность из-за скрытой съёмки.
Альтман о рисках ИИ. Сэм Альтман заявил, что обществу стоит принять «некоторые плохие вещи»: пользы от ИИ будет на порядки больше. Его слова прозвучали как раз тогда, когда пиарщик пытался прервать вопросы о самоубийстве пользователя ChatGPT.
Публика хочет замедлить ИИ. Опрос Quinnipiac показал: 47% американцев хотят замедлить развитие ИИ, 30% — остановить его до подтверждения безопасности; 91% поддерживают ограничения, а 74% не доверяют лидерам отрасли.
На сегодня всё - около 5 минут чтения.