Agentic AI News Сегодня

Новости об AI-агентах за день в одном 5-минутном чтении: релизы, инструменты, исследования, финансирование и корпоративные шаги.

Обновляется ежедневно отобрано из 30 источников Четверг, Октябрь 8, 2026

Модели и интерфейсы

Claude Haiku 5.5. Новая быстрая и недорогая модель Anthropic получила контекст на 1 млн токенов и снизила цену промпта до $0,10 за миллион токенов в пределах 100 тыс. — на уровне GPT-6 Luna. Правда, её токенизатор считает примерно на 25–30% больше токенов, а после 100 тыс. токенов цена вырастает в 5 раз. По бенчмаркам — заметный скачок относительно Haiku 4.5 и конкурентоспособные результаты в агентном кодинге.

Mistral Large 4 «Le Chonk». Mistral выпустила в превью открытую модель на 1 трлн параметров. Она оптимизирована под код, киберзащиту и отдельные отрасли, а по заявлению компании близка по возможностям к передовым моделям США и Китая.

Decision-модели Liquid AI. Liquid AI открыла исходный код d1-3B и d1-omni-600M — мультимодальных decision-моделей, которые возвращают калиброванный ответ «да/нет», выбор из вариантов или оценку, не тратя ни одного выходного токена. d1-3B заявлена как лучшая в классе до 10B по Decision Index и работает всего за 16 мс на железе NVIDIA Jetson; появился и порт под WebGPU для браузера.

OpenAI Decisions API. OpenAI запустила бета-версию Decisions API: оценки «да/нет», по категориям и по шкале — по тексту или изображениям. По словам компании, это примерно в 10 раз быстрее Responses. Поддерживается GPT-6 Luna: $0,10 за миллион входных токенов, выходные — бесплатно.

Интерактивный интерфейс ChatGPT. С GPT-6 ChatGPT выдаёт вместо простого текста интерактивные графики, кнопки, формы и мини-приложения. В OpenAI говорят, что рассуждения стартуют уже во время «размышления», чтобы сократить ожидание: платные пользователи получают GPT-6 Sol, бесплатные — Luna.

Генерация видео в Kandinsky 6.0. Kandinsky Lab выпустила Kandinsky 6.0 Pro (29B) и Lite (3B) с поддержкой ComfyUI и Diffusers; добавился апскейлер для видео.

Nemotron на олимпиадах. Дообученные модели Nemotron показали золотой неофициальный результат на IOI 2026 (535,4 из 600) и официальное золото IMO 2026 с 30 из 42 баллов, используя SFT, RL и схему generate-verify-refine.

Агенты и фреймворки

Агенты Nous Research. Nous Research привлекла $90 млн при оценке $1,5 млрд и запустила Hermes for Businesses — продукт для корпоративных ИИ-агентов. Её открытый Hermes Agent скачали 24 млн раз, и на него, по оценкам, приходится 2,5% мирового потребления ИИ-токенов.

Deep Agents в LangChain. LangChain представила обновление Skills, которое привязывает инструменты к навыкам, чтобы контекст оставался компактным, а также Managed Deep Agents v0.9 с расписаниями, которые создаёт сам агент, настройкой для каждого запуска и реакциями в Slack.

Copilot и локальные файлы. Hybrid Intelligence от Microsoft позволит Copilot работать с локальными файлами и выполнять действия в Windows: находить, переименовывать, архивировать и отправлять документы почтой за пользователя.

Muse на iPad. Агентный ассистент Meta Muse получил нативную поддержку iPad — после 6,6 млн установок — и обзавёлся коннекторами к таким сервисам, как Canva, GitHub и QuickBooks.

Agent Lightning v1.0. Microsoft Research открыла исходный код Agent Lightning v1.0 — фреймворка для агентного RL на 3500 строк, который использует реальные продакшен-обвязки и нативный Kubernetes. В одном из примеров он поднял Pass@1 у Qwen3.5-9B на SWE-bench Verified с 41,8% до 56,4%, потратив около 6000 обучающих примеров.

Локальный ИИ и инструменты разработчика

ROCm 10.1. ROCm 10.1 от AMD нацелена на узкое место с перемещением данных при локальном инференсе; релиз обсуждают пользователи локального ИИ на Reddit.

Ускорение MoE в llama.cpp. В llama.cpp появился GPU-кэш для экспертов MoE, которые держатся в памяти хоста, — это обещает серьёзное ускорение для моделей, не помещающихся целиком в VRAM. Заодно добавили поддержку MTP для GLM5Next.

Проверка репозиториев в Unsloth Studio. Unsloth Studio теперь перепроверяет доверенные репозитории моделей перед запуском. Поводом стали скомпрометированные версии LiteLLM в PyPI, показавшие, как атаки на цепочку поставок добираются до ИИ-инструментов.

GLM-5.3-Flash на двух GPU. Сборка из двух CMP 170HX по 64 ГБ запускает GLM-5.3-Flash с контекстом 384K и примерно 90 токенов/с на EXL3: 320B MoE держит активные веса в HBM, а результаты сравнивают с Qwen3.8-Flash-Next.

Локальные бенчмарки Qwen. В свежих оценках сообщества дообученные Qwen3.8-27B и Qwen3.8-Flash-Next сравнивают с передовыми моделями на отраслевых и кодовых задачах. Прогон из 469 вопросов показал: локальные модели могут приближаться к результатам фронтирных — с приватностью и меньшими затратами, хотя перерасход thinking-токенов остаётся проблемой.

Железо и Windows

Новые Surface с ИИ. Microsoft анонсировала Surface Laptop Ultra и Surface RTX Spark Dev Box — обе на Arm-чипе RTX Spark от Nvidia. Ноутбук стоит от $2599 и несёт до 128 ГБ унифицированной памяти, поставки с 16 октября. Dev Box стоит от $5999 и рассчитан на запуск локальных моделей от 120B.

Индустрия и бизнес

Разрыв в понимании кода. Опрос 300 старших инженерных руководителей показал, что ИИ-агенты для кодинга сместили узкое место в сторону отладки и понимания. Команды тратят 9,8 часа в неделю на написание кода и 16,9 часа — на его отладку. В отчёте говорится о растущем риске для критичных кодовых баз.

Инициатива виртуальной клетки. Biohub координирует проект стоимостью $1,8 млрд по созданию ИИ-моделей, предсказывающих поведение клеток. Google DeepMind, Meta и Isomorphic Labs вкладывают $300 млн, а Минэнерго США — более $500 млн на лабораторные измерения и вычисления.

Открытые клоны приложений Adobe. Разработчик Брэндон Томас с помощью Claude Opus 5.5 собрал Artcraft — набор из семи открытых приложений на Rust/WebAssembly, повторяющих Photoshop, Illustrator, Premiere и другие продукты Adobe. Приложения ранние и полны недостатков, но проект демонстрирует clean-room-перереализацию с помощью ИИ.

SynthID открыли для всех. Google открыла детектор SynthID для всех желающих: теперь любой может проверить изображения, видео и аудио на водяные знаки Google и её партнёров. Система уже разметила более 180 млрд единиц медиаконтента и встроена в Chrome и Gemini.

Playground от Google Labs. Google Labs запустила Playground — браузерную платформу, где совершеннолетние пользователи из США могут создавать игры по текстовому описанию. Работает на Gemini, Nano Banana и Lyria. Unity тем временем анонсировала Unity Spark для профессиональной разработки игр с помощью ИИ.

На сегодня всё - около 5 минут чтения.

Читайте каждое утро прямо в браузере

Расширение открывает этот дайджест в боковой панели Chrome — один клик, без регистрации.

Добавить в Chrome — Бесплатно