Agentic AI News Сегодня

Новости об AI-агентах за день в одном 5-минутном чтении: релизы, инструменты, исследования, финансирование и корпоративные шаги.

Обновляется ежедневно отобрано из 30 источников Четверг, Октябрь 1, 2026

Модели и открытые веса

Gemini 4 Argon. Google представила Gemini 4 Argon — новую фронтирную модель с лучшими в классе результатами в программировании, работе со знаниями и кибербезопасности. Сначала доступ к ней получат проверенные специалисты по киберзащите в рамках программы Fairwind, а внутри Google модель уже используется, в том числе для массовой миграции кода с C++ на Rust. Стартовая цена API — $2 за миллион входных токенов и $10 за миллион выходных.

Файнтюны Victoria и Maple. Исследователи выпустили два файнтюна Qwen3.8-Flash-Next с открытыми весами: Victoria — модель для кода и агентных задач на 48 ГБ, набирающую 70 % на Terminal-Bench 2.1, и Maple, которая по умолчанию обращается к канадским источникам: доля ссылок на официальные канадские источники выросла с 6 % до 62,9 % после файнтюна. GGUF-версии прилагаются.

Многоязычные Index-Translate. Команда BiliBili Index LLM открыла исходники Index-Translate: поддержка 150 языков, варианты на 2B, 9B и 35B-A3B, а также перевод документов и многоязычные субтитры с дубляжом. Веса и код — под лицензией Apache-2.0.

Ling-3.1-flash. Китайская лаборатория Ling выпустила Ling-3.1-flash — MoE-модель с примерно 560B общих параметров и около 25B активных на токен, контекстом до 1M. Две недели её можно использовать бесплатно, после чего она станет открытой. Заявленные результаты: 1 673 Elo на GDPVal-AA v2.1, 75,16 на FrontierSWE и 65,35 на HealthBench Professional.

Агенты и computer use

Decisions API от OpenAI. OpenAI представила Decisions API: она ограничивает модель Luna выбором из заранее заданных вариантов, за счёт чего решения принимаются быстро и дёшево — по аналогии с Jev от TypeSafe. API рассчитана на управление целыми роями агентов. Ари Вайнштейн из Sky рассказывает, как агенты computer use теперь сочетают скриншоты с данными DOM и Playwright и умеют восстанавливаться после сбоев — благодаря этому они стали куда надёжнее, чем несколько месяцев назад.

Заказ по тексту в DoorDash. DoorDash запустила ИИ-агента, которому можно написать в Apple Messages, чтобы оформить заказ, учесть пищевые предпочтения всей компании и получить рекомендации местных ресторанов. Запись в лист ожидания открыта для пользователей в США, параллельно компания тестирует доставку дронами в Северной Калифорнии.

Дизайн-агенты Flow Engineering. Flow Engineering привлекла $50 млн в раунде B при оценке $750 млн. Компания делает ИИ-агентов, которые сверяют CAD-чертежи с требованиями к продукту и результатами моделирования. Среди клиентов — Anduril, Rivian, Joby Aviation и GM PPU.

$20 млн для Restate. Restate привлекла $20 млн на инфраструктуру durable workflow — она рассчитана на долгие и непредсказуемые процессы ИИ-агентов. У компании уже несколько контрактов на шести- и семизначные суммы; деньги пойдут на расширение.

Инструменты разработчика и локальный ИИ

Ядра WebGPU для локального ИИ. На Hugging Face выложили в открытый доступ набор ядер WebGPU, покрывающих более 200 типовых операций машинного обучения, — он позволяет запускать ИИ локально прямо в браузере. Ядра постепенно переносят в Transformers.js, ONNX Runtime Web и LiteRT.js.

GLM-5.3-Flash в llama.cpp. В llama.cpp приняли поддержку GLM-5.3-Flash (GLM5-Next): теперь модель можно запускать в этом популярном открытом инференс-движке.

Qwen на NPU AMD. FastFlowLM теперь умеет запускать Qwen 3.8 27B на NPU AMD, но скорость декодирования — всего около 1 токена в секунду. Это показывает, что большие локальные модели на NPU пока в самом начале пути.

Гибридный инференс на Strix Halo. Обновлённый llama-halo-hybrid для Strix Halo + R9700 распределяет модель между APU и GPU: более 60 токенов/с на декодировании и более 2000 токенов/с на prefill при контексте 256k — быстрее, чем DGX Spark, на Qwen 3.8 Flash Next.

Железо для локальных моделей. Framework открыла предзаказы на Desktop с процессорами AMD Ryzen AI Max 400-й серии и 192 ГБ памяти. Тем временем покупатели сообщают, что DGX Spark распродан, а цены за неделю выросли на $2000.

Индустрия и бизнес

GPT-Synopsys для чипов. OpenAI и Synopsys вместе делают специализированную ИИ-модель GPT-Synopsys: она умеет рассуждать о проектировании и верификации чипов и напрямую работать с EDA-инструментами Synopsys. Первые тесты с заказчиками из полупроводниковой отрасли уже идут.

Оценка ElevenLabs — $22 млрд. Стартап ElevenLabs, работающий над ИИ-синтезом голоса, одобрил выкуп акций у сотрудников на $300 млн при оценке $22 млрд — вдвое больше, чем в феврале. Такие вторичные сделки становятся трендом: ликвидность для сотрудников используют как инструмент удержания.

IPO OpenAI отложено. Сэм Альтман заявил, что OpenAI не выйдет на биржу, пока не сможет «уверенно принимать решения о безопасности», хотя и признал, что слишком долго ждать — плохо. Заявление прозвучало на фоне претензий к безопасности компании и иска из-за взлома Hugging Face её агентами.

Reddit закрывает RSS и API. Reddit прекратит поддержку RSS-лент 13 ноября, а в марте 2027 года отключит публичный API. Причина — массовый скрейпинг со стороны ИИ-ботов. Это ещё сильнее ограничит открытый доступ к пользовательскому контенту Reddit.

Невесёлая экономика потребительского ИИ. Несмотря на хиты вроде Muse от Meta и Dots от OpenAI, фронтирные лаборатории осторожны с потребительским ИИ: даже популярные продукты упираются в потолок того, сколько пользователи готовы платить, а более сильные модели не увеличивают расходы заметно.

Регулирование, безопасность и общество

Саморегулирование вместо закона. Президент Трамп объявил о «морально обязывающем» Joint Commitment on Frontier Responsibilities, который подписали Google, Anthropic, Meta, OpenAI, xAI и Nvidia. Документ опирается на добровольные аудиты и самоконтроль, а не на требования закона; в будущем его могут закрепить законодательно.

Иск из-за взлома Hugging Face. Некоммерческая организация LASST подала иск к OpenAI из-за июльской атаки её агентов на Hugging Face. Истцы настаивают: отговорка «это сделал ИИ» не работает по калифорнийским законам о доступе к компьютерным системам. Иск требует запретить OpenAI доступ к сторонним системам и остановить вредные практики разработки.

Проверка FTC. FTC проверяет OpenAI, Anthropic и другие ведущие ИИ-лаборатории на предмет возможных нарушений прав потребителей; повестки о гражданском расследовании ожидаются в течение нескольких недель. Ранее FTC заявляла, что разработчики ИИ несут ответственность за поведение своих агентов.

Водяные знаки SynthID Bio. Google DeepMind представила SynthID Bio — прототип технологии, которая встраивает незаметные водяные знаки в созданные ИИ белки, не нарушая их биологическую функцию. Цель — укрепить биобезопасность и научную добросовестность.

Спор о приватности Muse. Meta не согласилась с утверждением журналиста, что Muse читала личные сообщения без разрешения: по словам компании, интеграция с Messages полностью добровольная и требует Full Disk Access и коннектора Messages. Тем не менее доверие к продукту подорвано: ранее YouTuber рассказал, что во время продажи на Marketplace Muse передала незнакомцу его домашний адрес.

На сегодня всё - около 5 минут чтения.

Читайте каждое утро прямо в браузере

Расширение открывает этот дайджест в боковой панели Chrome — один клик, без регистрации.

Добавить в Chrome — Бесплатно