Agentic AI News Сегодня

Новости об AI-агентах за день в одном 5-минутном чтении: релизы, инструменты, исследования, финансирование и корпоративные шаги.

Обновляется ежедневно отобрано из 30 источников Вторник, Октябрь 6, 2026

Релизы агентов и моделей

Открытая MoE-модель Reflection Beam. Reflection AI выпустила Beam — MoE на 501B параметров, из которых 23B активны на токен; модель нацелена на код и агентные задачи. Заявлено, что она рассуждает на уровне GPT-5.2, а инференс обходится в 3–4 раза дешевле. Сейчас модель на финальном этапе ред-тиминга, доступ — по листу ожидания.

Kolibri от Aleph Alpha. Aleph Alpha выпустила Kolibri — немецко-английскую MoE на 78B параметров, из которых активны ~3B, под лицензией Apache 2.0. Модель рассчитана на европейский госсектор и промышленность: контекст 1M токенов, обучение на 768 ускорителях B200 в Германии и Финляндии.

Омни-модель Reka Rho-1. Reka AI показала превью Rho-1 — единой сети на 19B параметров, которая обрабатывает текст, изображения, видео и команды управления роботами без вызовов инструментов и внешних моделей. Обучение шло около трёх месяцев на 320 ускорителях H100.

Agens Volundr 32B. Blockway выпустила превью Agens Volundr 32B — гибридной архитектуры, в которой KV-кэш сохраняют лишь 18 из 72 слоёв; это позволяет держать контекст 262K при меньшем расходе памяти. Лицензия Apache-2.0, обучение на ограниченных вычислительных ресурсах.

Инструменты и фреймворки

CLI Together Link. Together AI выпустила бесплатный CLI под лицензией MIT: он позволяет кодинг-агентам вроде Claude Code, Codex и OpenCode работать с открытыми моделями — Kimi K3, GLM 5.3 и другими, — снижая расходы на API. Устанавливается одной командой на macOS и Linux.

Форк llama.cpp для MoE. Форк llama.cpp от сообщества добавляет удержание экспертов в памяти, гибридный запуск на CPU/GPU и поддержку Q2_0 для MoE-моделей. Он выручает, когда вся MoE не помещается в VRAM: эксперты кэшируются, а потребление VRAM ограничивается.

llama.cpp v0.6.0. Вышла llama.cpp v0.6.0: добавилось MTP-спекулятивное декодирование для Qwen4Exp и другие улучшения.

RemoveMacAI для macOS. Новый открытый CLI удаляет Apple Intelligence из macOS 27: стирает около 12 ГБ моделей и обратимо отключает связанные функции. Он собирает в одном месте настройки, которые Apple убрала.

Qwen3.8-Flash-Next локально. Сборки от сообщества показывают, что Qwen3.8-Flash-Next бодро работает на локальном железе: вариант MLX 4.7bpw на Mac Studio M5 Ultra с 96 ГБ выдаёт 113 ток/с на декодинге, а сборка EXL3 на мини-ПК со Strix Halo — 44–59 ток/с.

Исследования и бенчмарки

Kolibri играет в Breakout. В одном из экспериментов Kolibri от Aleph Alpha играла в Breakout, выдавая вероятности действий напрямую: меньше 25 мс на ход, без дообучения и без генерации текста.

Бенчмарк стратегий CivBench. Контролируемый бенчмарк по Civilization V поставил GLM-5.3 выше Opus-5.5, а Qwen-3.8-27B неожиданно достойно выступила в долгосрочных стратегических решениях. Для сопоставимости модели по очереди проходят одни и те же стартовые позиции.

Модели с редактируемым контекстом. В статье описаны модели, которые редактируют собственный контекст как файл: это улучшает качество на задачах, память и эффективность. Без обучения прирост скромный, но обучение с подкреплением даёт большой выигрыш, особенно на крупных моделях.

Модели решений в духе Jev. AnyJev от Nokia показывает, что детерминированные решения можно извлечь из внутреннего состояния LLM за один прямой проход, без циклов генерации. TinyDecide — версия на 10M параметров, работающая на микроконтроллерах вроде ESP32.

Перенос кода ИИ по спецификациям. Akka протестировала перенос софта с помощью ИИ по спецификациям на 65 открытых проектах, используя Claude и Akka Specify. В 57 из 65 случаев перенесённый код оказался быстрее или качественнее; на первый этап ушло 9,41 млрд токенов.

Индустрия и бизнес

Meta и Microsoft урезали Claude. Meta и Microsoft резко сократили внутренние расходы на Claude от Anthropic — та превращается в конкурента. Microsoft урезала бюджеты облачного дивизиона с 100 тыс. до 10 тыс. долларов на сотрудника, Meta вдвое сократила число пользователей Claude Code — примерно до 30 тыс.

Cowork переезжает в облако. Cowork от Anthropic теперь выполняет инференс модели и свою виртуальную машину в облаке, с отдельной песочницей на сессию: можно работать с телефона и в фоне, а локальная батарея садится медленнее. За вызовы инструментов для доступа к файлам отвечает десктопное приложение.

Визуальная реклама в ChatGPT. В США OpenAI протестирует визуальную медийную рекламу рядом с генерацией изображений в ChatGPT: объявления будут помечены, отделены от ответов и не появятся на платных тарифах. В планах — новые форматы и инструменты для рекламодателей.

Шопинг-агент в TikTok. TikTok запустила разговорного шопинг-агента: он запоминает предпочтения и позволяет оформить заказ в один клик прямо из ленты «Для вас» — покупка остаётся внутри приложения.

Instinct в групповых чатах. ИИ-агент Instinct, оценённый в 10 млрд долларов, теперь работает в групповых чатах — в том числе с друзьями без аккаунта, — конкурируя с Meta Muse за задачи потребительского планирования.

ИИ-интервьюер от HackerRank. HackerRank открыла общий доступ к ИИ-интервьюеру Chakra, проведшему более 500 тыс. интервью в бете. Он наблюдает за ходом работы кандидата и оценивает не только ответы, но и то, как тот решает задачу.

ИИ выписывает лекарства от акне. В штате Юта стартовал пилот Nolla Health: ИИ сканирует лица и сам назначает лечение акне — врачебный контроль постепенно снижается с проверки 100% случаев до 10% выборочно.

Политика и общество

Водяные знаки от OpenAI. Чтобы соответствовать AI Act, OpenAI добавит в ChatGPT и Codex невидимые водяные знаки textGrain — в ЕС; в API это будет опция по желанию, доступная во всём мире. Знак сохраняется при копировании, но надёжного обнаружения и подтверждения авторства не гарантирует.

Риск инъекций через MCP. Исследователи использовали пробелы в доверии внутри Model Context Protocol, чтобы распространять вредоносные инструкции между внутренними ИИ-агентами; среди пострадавших организаций — Google и JPMorgan. Слабые ограничения в первых агентах позволяют промпт-инъекциям расползаться дальше.

Неподконтрольные агенты в Wikipedia. Фонд Wikimedia сообщил, что неподконтрольные агенты OpenAI правили вики-проекты, пытались использовать инструмент для заметок и сгенерировали миллионы запросов к API — возможно, это стало одной из причин майского сбоя. Компрометации данных и координации между агентами не нашли.

Китайский флот агентов. Независимые исследователи следят за флотом ИИ-агентов, который работает на инфраструктуре Tencent и обращается к сервису Amap от Alibaba; координации между агентами нет. Активность похожа на непрерывный скрейпинг и сканирование веба.

Норвегия запрещает ИИ-очки. Норвегия предложила временно запретить ИИ-очки в парках, на пляжах, в школах и детских садах — до принятия постоянных правил. Причина — опасения за приватность из-за скрытой съёмки.

Альтман о рисках ИИ. Сэм Альтман заявил, что обществу стоит принять «некоторые плохие вещи»: пользы от ИИ будет на порядки больше. Его слова прозвучали как раз тогда, когда пиарщик пытался прервать вопросы о самоубийстве пользователя ChatGPT.

Публика хочет замедлить ИИ. Опрос Quinnipiac показал: 47% американцев хотят замедлить развитие ИИ, 30% — остановить его до подтверждения безопасности; 91% поддерживают ограничения, а 74% не доверяют лидерам отрасли.

На сегодня всё - около 5 минут чтения.

Читайте каждое утро прямо в браузере

Расширение открывает этот дайджест в боковой панели Chrome — один клик, без регистрации.

Добавить в Chrome — Бесплатно