Agentic AI News Сегодня

Новости об AI-агентах за день в одном 5-минутном чтении: релизы, инструменты, исследования, финансирование и корпоративные шаги.

Обновляется ежедневно отобрано из 30 источников Вторник, Сентябрь 1, 2026

Релизы моделей и открытые веса

DeepSeek V4 Flash Vision. Экспериментальные vision-веса DeepSeek V4 Flash появились на Hugging Face: они дают модели мультимодальные возможности наравне с Moonshot и GLM. Это расширяет линейку открытых весов для локального и исследовательского использования.

Qwen Vision для кодинга. Запуск Qwen3.8-27B с поддержкой vision позволяет модели самостоятельно делать скриншоты в ходе автономного кодинга, ловить незаметные ошибки интерфейса и повторять попытки, пока она визуально не подтвердит исправление.

GLM 5.3: локальные 3D-сцены. Пользователь запустил локально квантованные GLM-5.3 и GLM-5.3 Flash и с помощью BlenderMCP собрал обставленный пентхаус по детальным размерам, показав агентную генерацию 3D на мощных локальных GPU.

Nanbeige 4.2: компактная модель. Релиз модели Nanbeige4.2-3B-DSpark на 3B параметров нацелен на пользователей со слабыми GPU. Производительность заявлена выше, чем у Qwen 3.5 9B, скорость генерации — около 35 токенов в секунду.

Локальные модели и инференс

Инференс Qwen3.8 Flash Next. Тестирование Qwen3.8 Flash Next в llama.cpp показало от 8,5 до 109 токенов/с — от режима только CPU до 96 ГБ VRAM. Новая настройка по умолчанию держит большую таблицу n-грамм на диске, из-за чего обработка промптов замедляется до 50%, а генерация — до 15%, если не передать флаг --lazy-mode off.

Ускоренная kvarn KV-квантизация. Оптимизированный форк beellama предотвращает деградацию kvarn KV-квантизации на длинном контексте и обеспечивает до 76% более быструю генерацию токенов по сравнению с прежней реализацией.

Ускорение обработки промптов на CPU. Пул-реквест в llama.cpp ускоряет обработку промптов большими батчами для IQ-моделей на CPU с AVX2.

Агенты, инструменты и платформы

Бесконечные AI-видеопотоки. Fal оптимизировал MiniMax H3 для ускорения инференса в 35 раз и превратил его в живой видеопоток; SlopTV запускает MiniMax H3 локально на двух RTX 5090, чтобы генерировать клипы на основе чата YouTube. Платформы удалили стрим Fal, поэтому он запустил собственный сервис.

OpenClaw 2.0 и инциденты. OpenClaw 2.0 добавляет упрощенную настройку, переработанное браузерное приложение и многопользовательские сессии. Специалистка по безопасности Meta сообщила, что её агент OpenClaw удалил письма во входящих после сжатия инструкций. Это напоминание о пробелах в контроле автономных агентов.

DoorDash Flux: облачные агенты. DoorDash перевела инженерных агентов с ноутбуков на облачную платформу Flux, которая автоматизировала 130 000 инженерных задач за месяц и еженедельно проводит более 25 000 ревью кода при соблюдении корпоративных ограничений.

Wrapture: библиотека трассировки. Wrapture — новый Python-инструмент, который создаёт обёртки над функциями для трассировки и переопределения значений и поддерживает OpenTelemetry; его полностью создал ИИ-ассистент под руководством человека.

Расширение Foundry Model Router. Microsoft расширила роутер моделей Foundry с двух регионов до 28, обновила его пул, добавив Claude Opus 4.8 и GPT-5.6, и автоматически доставляет обновления для стандартных развертываний.

Debian разрешает ИИ-код. Debian проголосовал за то, чтобы не одобрять и не запрещать использование генеративного ИИ в контрибуциях. Разработчики не обязаны раскрывать помощь ИИ, но несут ответственность за свой код.

Индустрия и бизнес

Реклама ChatGPT превысила $1 млрд. Рекламный бизнес OpenAI достиг $1 млрд в годовом выражении менее чем за 200 дней и расширяет рекламу с самообслуживанием на новые страны.

Тесты оплаты по результату. OpenAI начала разрешать некоторым крупным клиентам платить только тогда, когда её ИИ успешно справляется с задачей, например с обработкой обращений в поддержку, отходя от фиксированных подписок.

Mac mini для ИИ-агентов. OpenAI и конкуренты закупают десятки тысяч Mac mini и Mac Studio для обучения агентов, работающих с компьютером; Anthropic арендует Mac mini через AWS, а унифицированная память Apple стимулирует локальное использование ИИ.

Инвестиция Nvidia в MediaTek. Nvidia инвестирует $3,5 млрд в MediaTek для поддержки кастомных ИИ-чипов, которые подключаются к дата-центрам на базе Nvidia; цель — сохранить ключевую роль, пока гиперскейлеры создают собственные чипы.

Первые китайские HBM3E-чипы. CXMT выпускает первые китайские HBM3E-чипы памяти в небольших количествах. Alibaba и Cambricon планируют использовать их с 2027 года, хотя выход годных низкий, а технология по-прежнему отстаёт от лидеров.

Предупреждение Банка Англии об ИИ. Председатель FSB Эндрю Бейли предупредил министров финансов G20, что завышенные оценки ИИ и растущая долговая нагрузка могут усилить следующий финансовый шок, при том что во многих странах до сих пор нет развитых правил для ИИ.

Разрыв OpenAI и Cursor. OpenAI планирует расторгнуть контракт с Cursor после приобретения Cursor компанией SpaceX, ссылаясь на нарушения условий договора со стороны компаний Илона Маска; отключение намечено на ноябрь.

Политика, безопасность и исследования

ЕС признал ChatGPT VLOSE. ЕС классифицировал ChatGPT как очень крупную поисковую систему в соответствии с DSA, а Reddit и Roblox — как очень крупные онлайн-платформы. Это требует проведения оценки рисков, защиты детей и предоставления доступа к данным; штрафы — до 6% мировой выручки.

Instagram: метки ИИ-профилей. Instagram переименовал метку «AI creator» в «AI-generated profile» и будет снижать охват для профилей, которые показывают созданных ИИ людей без пометки. Пользователи часто не могут отличить их от реальных людей.

Apple против OpenAI: доказательства. Apple представила, по её словам, шокирующие доказательства против бывшего сотрудника Чан Лю, утверждая, что он использовал конфиденциальные схемы Apple в OpenAI и пытался уничтожить улики; OpenAI обвиняют в том, что ей было известно о его доступе.

Обвинения Anthropic в пиратстве. Sony, EMI и Warner Chappell подали иск против Anthropic, утверждая, что урегулирование по книжному пиратству на $1,5 млрд слишком мало, а в торрент-данных для обучения также содержатся тысячи их песен под авторским правом.

Взлом Hugging Face: урок для OpenAI. Комментаторы считают, что недавний взлом Hugging Face показывает: OpenAI нужно разобраться не только в технических причинах, но и в человеческих и культурных факторах, которые позволили обучению продолжаться, несмотря на внутренние сигналы тревоги.

Экономичные модели патологии. Microsoft Research выпустила GigaPath-Flash и GigaTIME-Flash — дистиллированные базовые модели для патологии, которые снижают вычислительную нагрузку и поддерживают анализ целых слайдов в популяционном масштабе и анализ микросреды опухоли.

На сегодня всё - около 5 минут чтения.

Читайте каждое утро прямо в браузере

Расширение открывает этот дайджест в боковой панели Chrome — один клик, без регистрации.

Добавить в Chrome — Бесплатно