Релизы моделей и агентов
Grok 4.6 и Grok Bot. SpaceXAI выпустила Grok 4.6, который сравнялся с GPT-5.6 Sol от OpenAI и уступает только Claude Opus 5 в индексе Artificial Analysis, при этом предлагая более низкие цены, чем другие передовые модели. Также представлен Grok Bot — постоянно активный ИИ-напарник, который работает из собственного облачного компьютера для выполнения поставленных задач.
Qwen 3.8 большая и малая. Qwen3.8-2.4T-A95B теперь доступна, а страница 27B Qwen3.8 ненадолго появилась на ModelScope, прежде чем была удалена, что указывает на скорый релиз. Энтузиасты локального запуска уже планируют разбиение модели 2.4T по оборудованию.
Обновление DeepSeek V4 Pro. DeepSeek V4 Pro 0813 доступен через API на OpenRouter, официальной страницы анонса пока нет; вероятно, будут открытые веса, учитывая предыдущие релизы. Его поведение при рассуждении заметно различается на низком, среднем и высоком уровнях.
Edge-модели зрения. LFM2.5-VL-3B от Liquid AI обеспечивает значительно более сильную привязку к пользовательскому интерфейсу и может работать на телефонах, а Apache-2.0 North Micro Vision от Cohere предлагает поддержку изображений в исходном разрешении в компактном пакете с 2,4 млрд параметров.
Модель Nvidia с триллионом параметров. По сообщениям, Nvidia строит Nemotron 4 с как минимум одним триллионом параметров и утраивает расходы на облачное обучение до $28 млрд к 2031 году, стремясь конкурировать с китайскими моделями с открытыми весами.
Разработка агентов и инструменты
Управляемые агенты и BYOC. LangChain запустила Managed Deep Agents как следующий шаг после фреймворков и сделала LangSmith BYOC общедоступным на AWS, позволяя предприятиям хранить трассировки агентов и данные в собственном VPC.
Приложение ChatGPT на Linux. OpenAI выпустила десктопное приложение для Linux, объединяющее ChatGPT, ChatGPT Work и Codex, но нативное использование компьютера недоступно при запуске.
Локальный инференс и оборудование
Цена RTX PRO 6000 удвоилась. Nvidia почти удвоила рекомендованную розничную цену 96GB RTX PRO 6000 Blackwell до $16,000, после того как в прошлом году предзаказы были ниже $8,000.
Стриминг DSpark на одной GPU. Один RTX PRO 6000 96GB может запускать DeepSeek V4 Flash 284B со скоростью около 31 токена в секунду с драфтером DSpark в системной оперативной памяти, что примерно на 15–17% быстрее, чем базовый уровень без драфтера при одинаковом использовании VRAM.
Muse Glimmer на Mac. Muse Glimmer 30B от Meta теперь работает до примерно 3,3 раза быстрее на Apple Silicon с использованием mlx-dspark, обеспечивая качество 8-бит при скорости, близкой к 4-бит, на Mac с 48GB памяти.
Квантование KV-кэша Gemma 4. Обучение с учетом квантования помогает Gemma 4 31B сохранять качество при агрессивном квантовании KV-кэша, делая инференс с большим контекстом более практичным.
Индустрия и бизнес
Cognition привлекает финансирование при оценке $40 млрд. По сообщениям, разработчик ИИ-агентов для кодирования Cognition ведет переговоры о привлечении средств при оценке в $40 млрд после достижения годовой выручки в $1 млрд, по сравнению с $492 млн три месяца назад.
Lovable достигает $13,3 млрд. Vibe-coding стартап Lovable привлек $400 млн при оценке в $13,3 млрд после превышения $500 млн годовой выручки, имея 60 миллионов размещенных проектов.
Thrive Holdings и корпоративный ИИ. Поддерживаемая OpenAI Thrive Holdings привлекла $2 млрд при оценке в $12 млрд для приобретения традиционных предприятий и внедрения ИИ, расширяясь за пределы бухгалтерского учета и ИТ.
Доля Gemini падает. Данные рынка от Pangram, OpenRouter и Similarweb показывают снижение использования Gemini: Pangram зафиксировал падение до 1,9% в AI-текстах, в то время как OpenAI удерживает более 50%.
Claude выходит в юридическую сферу. Anthropic наняла основателя legal AI Роберта Махари на должность первого главы Claude for Legal, развивая более ранние юридические плагины и партнерства.
Политика, безопасность и общество
Утечка в цепочке поставок LiteLLM. Атака на цепочку поставок LiteLLM раскрыла терабайты учетных данных более чем 2 500 организаций, включая Microsoft, Amazon и Samsung, через вредоносные пакеты PyPI.
Водяные знаки в выводах Claude. Anthropic теперь помещает водяные знаки в выводы Claude для соответствия EU AI Act, что расстраивает пользователей, которые опасаются, что это раскроет использование ИИ на работе или в учебе.
Twitch по умолчанию использует контент для обучения. Twitch будет по умолчанию обучать модели ИИ Amazon на контенте стримеров, теперь доступен переключатель отказа от этого; политика вызвала негативную реакцию.
ShieldFont заменяет текст. Дизайнеры выпустили ShieldFont — шрифт, который отображает обычный текст для пользователей, но заменяет слова в базовом HTML, чтобы отравлять скраперы.
Хинтон, Ли и Нг об открытом ИИ. На Ai4 Джеффри Хинтон, Фей-Фей Ли и Эндрю Нг выступили за сохранение открытости ИИ, чтобы избежать контроля доступа со стороны нескольких компаний, несмотря на опасения по поводу безопасности открытых весов.
Уничтожение редких книг. Продавцы книг опасаются, что ИИ-компании скупают редкие книги и уничтожают их для обучения, несмотря на неразрушающие альтернативы сканирования.
Исследования и бенчмарки
Топологическое рассуждение MindTopo. Бенчмарк MindTopo от Microsoft Research показывает, что мультимодальные модели хорошо справляются со статическим топологическим распознаванием, но испытывают трудности с интерактивным планированием, требующим поддержания отношений во времени.
Восстановление промптов из вывода. IIT Bombay и Adobe Research разработали Previous-Token Prediction, который может восстанавливать промпты LLM из выходного текста с почти идеальной точностью без весов модели.
На сегодня всё - около 5 минут чтения.