Релизы и обновления моделей
Ox Alpha: тихая модель. Новая скрытая модель Ox Alpha, судя по всему, основана на GLM или Mimo, но детали не подтверждены. Ее описывают как передовую для эффективного написания кода, длительной агентной работы и использования в проде.
SenseNova U1.5-Lite. SenseNova выпустила U1.5-Lite — единую модель, которая объединяет узкоспециализированных экспертов для рендеринга текста, эстетики и редактирования изображений. Она лучше справляется со сложными инструкциями, поддерживает нативную генерацию 4K и точнее редактирует изображения.
Tencent Hunyuan Hy4. Tencent начала постепенное тестирование нового флагмана Hunyuan Hy4 в приложении Yuanbao. Модель заявлена как экспертная, поддерживает использование инструментов и позиционируется выше Hy3 и DeepSeek.
Внутренняя Model 2 Anthropic. В отчете Anthropic о рисках раскрывается, что самая мощная модель компании под кодовым названием Model 2 предназначена только для внутреннего использования. Она превосходит публичные модели Claude и активно применяется для кодинга и исследований.
Базовые чекпоинты Ling-3.0. AntLing выпустила шесть базовых чекпоинтов для Ling-3.0 в двух размерах и на трех этапах обучения. Все они распространяются под лицензией MIT и предназначены для дальнейшего предобучения и исследований.
Агентные продукты и платформы
Плагин ChatGPT для Messages. OpenAI запустила плагин для Apple Messages, который позволяет ChatGPT анализировать, составлять и отправлять сообщения. Плагин работает с Codex и ChatGPT Work. Подробности о конфиденциальности пока не раскрываются.
Meta AI для Mac. Meta выпустила приложение для Mac с системной диктовкой и пониманием экрана через Muse Spark, а также добавила бизнес-интеграции для рекламы и Google Workspace.
Каналы Slack для вайб-кодинга. В Slack появились каналы для совместного вайб-кодинга: команды могут упоминать ИИ-агентов вроде Claude или Devin, просматривать диффы и проверять результат перед выкаткой.
Binance Agent OS. Binance запустила Agent OS — платформу, которая позволяет ИИ-агентам анализировать рынки и совершать сделки. Пользователи задают лимиты, поддерживается MCP.
Ramp запускает Router. Ramp запустила Router — сервис маршрутизации ИИ-моделей, дающий доступ к нескольким LLM-провайдерам и стратегиям. До конца 2026 года он бесплатен.
Инструменты и фреймворки
LangSmith Preview Builds. В LangSmith появились Preview Builds: теперь команды могут тестировать изменения агентов из PR-веток в изолированных средах, приближенных к продакшену, до мержа.
CUDA MCP от NVIDIA. NVIDIA выпустила хостируемый CUDA MCP-сервер, который помогает ИИ выполнять операции с CUDA: искать официальную документацию, писать оптимизированный GPU-код и анализировать производительность.
Скилл /wayfinder. Мэтт Покок выпустил /wayfinder — скилл, который помогает агентам планировать проекты с неясным конечным состоянием. Он решает проблему планирования в условиях «тумана войны».
LFM2.5-DSpark. Hugging Face анонсировала DSpark для моделей LFM2.5: до 3,2 раза более быстрый инференс на GPU и 2,87 раза на устройстве, а также на 57% меньшая задержка вызова функций.
Исследования и бенчмарки
Производительность Qwen3.8-27B. Разработчик оптимизировал Qwen3.8-27B до 381 токена в секунду на RTX 3090 и получил на AIME 2026 результат 29/30 с FP8 и высоким уровнем рассуждений. Это соответствует уровню Claude Opus 4.6.
GEN-1.5: one-shot обучение. Модель GEN-1.5 от Generalist AI обучает роботов новым задачам на основе одной демонстрации длительностью 3–12 секунд. Средний успех — 59%, а после 10 шагов обучения — 83%.
ИИ-тексты на веб-страницах. Согласно данным Pew Research, более трети веб-страниц, опубликованных после появления ChatGPT, несут признаки авторства ИИ. Выводы основаны на детекторе Pangram и данных Common Crawl.
Гардрейлы выдают ИИ. По мнению CTO Pangram, гардрейлы после обучения вызывают коллапс мод, из-за чего текст LLM становится детектируемым. Базовые модели и узконаправленные файнтюны при этом обходят детекцию.
Саттон о синтетических данных. Ричард Саттон утверждает, что синтетические данные не решат проблему масштабирования, и называет их «большой ошибкой» из-за бесконечной сложности мира.
Тао о кризисе математики. Теренс Тао считает, что ИИ может спровоцировать крупнейший кризис математики со времен Гёделя, заставив пересмотреть, что считать математическим вкладом.
Индустрия и бизнес
Бум данных Micro1. Стартап Micro1 по созданию данных для обучения ИИ за восемь месяцев увеличил валовую выручку в годовом выражении с $100 млн до $500 млн. Чистая выручка — около $150–200 млн. Причина — взрывной спрос на уникальные данные для обучения ИИ.
OpenAI против Anthropic. Данные Ramp показывают, что среди американских бизнес-пользователей Anthropic опережает OpenAI: 44% против 40%. Однако OpenAI с начала третьего квартала растет быстрее.
Иск Runlayer и Rippling. Runlayer и Rippling отозвали иски друг к другу из-за конкуренции MCP-шлюзов. Rippling в ответ сразу же выпустила свой MCP-шлюз.
Брокман в OpenAI. Грег Брокман тихо усилил свое влияние в OpenAI: в должности президента он управляет повседневными операциями, а Сэм Альтман остается гендиректором. Это происходит в преддверии IPO.
Китай догоняет США в ИИ. Согласно анализу Decoder, китайские Kimi K3 и GLM-5.3 почти вплотную приблизились к американским моделям. Это смещает конкурентное преимущество с лидерства в моделях на другие факторы.
Циркулярное финансирование Unitree. Оценка китайской Unitree в $50 млрд при IPO опирается на государственные центры, которые покупают роботов и продают ей обратно данные для обучения. Это вызывает опасения по поводу циркулярного финансирования.
Безопасность и надежность
Промпт-инъекция в Grok. Исследователи показали, что Grok может выводить пользовательские данные, если вредоносные инструкции зашифрованы. Об этом xAI уведомили в июне, но проблема сохраняется.
Баг Grok с бессмыслицей. Grok отправлял некоторым пользователям Grok.com бессвязные ответы. xAI подтвердила редкую временную проблему с генерацией.
На сегодня всё - около 5 минут чтения.