Релизы агентов и моделей
Агент Muse от Meta. Muse даёт каждому пользователю постоянную виртуалку с Ubuntu, где агент может ставить софт, выполнять код и работать в браузере. Meta открывает ранний доступ к новым функциям и активно продвигает продукт — уже более 3,4 млн загрузок. Критики вроде Джона Грубера предупреждают: потребители не осознают, насколько мощным и опасным может быть облачный компьютер с агентом.
- → Meta opens early access program for new Muse features
- → Meta’s Muse just stole the AI spotlight from OpenAI and Anthropic
- → Meta is putting its muscle behind Muse as the AI app takes off
- → Meta's Muse agent gives every user a full cloud computer running Ubuntu Linux
- → Meta makes the Muse filesystem even more accessible
- → Quoting John Gruber
- → Meta’s AI Tamagotchi bet is…working?
Autopilot в Copilot. В обновлённом приложении Copilot от Microsoft появился Autopilot — проактивный агент на базе OpenClaw. Он запускает собственный облачный компьютер, а вызвать его можно из Teams, Outlook или прямо из документа. Ещё добавили вкладку Code: собрать приложение на естественном языке теперь сможет и неразработчик.
Call for Me от Gemini. Google тестирует Call for Me для владельцев Pixel 11 с подпиской Gemini. Агент звонит в компании, проходит голосовые меню, ждёт на линии и показывает расшифровку разговора в реальном времени, чтобы пользователь мог вмешаться.
Открытые decision-модели Jev. Mica 4B — decision-модель под лицензией Apache: она оценивает варианты, не генерируя текст, работает на GPU с 8 ГБ и обучена менее чем за $30. В тестах на Minecraft и Tetris она обходит Kev 4B, а бенчмарки показывают, что Kev уступает Jev по точности решений не более чем на 2 пункта.
- → Mica v0.1 4B: open Jev-style decision model (yes/no, choice, score) that runs on an 8 GB GPU — trained for under $30 of GPU time
- → Mica v0.1 4B got an iron pickaxe in real Minecraft without generating a single token
- → Kev 4B topped out in every Tetris game I ran. Mica v0.1 4B cleared about 4x more lines and survived two of them to the end
- → Jev vs. Kev: open-source Jev alternative tested side by side
Ling Tiny 3.0. MoE-модель на 8 млрд параметров, из которых активен 1 млрд, выдаёт 10 токенов в секунду на CPU ноутбука 2017 года. Это делает локальные агентные циклы написания кода реальными на старой технике.
Инструменты и фреймворки
DistribAI v2. DistribAI v2 — платформа на C++/LibTorch для распределённого обучения на потребительских устройствах: она переживает падения узлов и отсекает злонамеренных участников. Разработчики рассказывают, что бесплатных GPU в Colab и Kaggle плюс локальной 4070 SUPER хватает, чтобы получить столько же вычислений, сколько дают несколько 5090.
MCP без состояния. В обновлённой спецификации MCP убрали сессии на уровне протокола и заголовок Mcp-Session-Id. Теперь запрос может попасть в любой экземпляр сервера за балансировщиком, а разворачивать MCP в AWS стало проще.
1Cat-vLLM для Volta. Форк vLLM под названием 1Cat-vLLM даёт оптимизированный инференс на картах V100. Авторы приводят замеры Qwen3.6-35B в сравнении со Strix Halo.
LangGraph и Jev. В блоге LangChain разобрали, как строить продакшен-агентов на Jev и LangGraph: структурированные decision-модели берут на себя маршрутизацию и классификацию, что снижает стоимость и задержки.
CobbleDB в Perplexity. Perplexity заменила DynamoDB на собственное key-value хранилище на Rust для поискового бэкенда. На нагрузке свыше 200 тыс. запросов в секунду это ускорило пакетное чтение в 5 раз и сократило расходы на хранение минимум на 20%.
Исследования
LLM взломали Enigma. Astra и Opus расшифровали два сообщения Enigma, которые не поддавались годами: модели работали в архивах, написали симуляторы и восстановили открытый текст. Редкий пример автономного исторического исследования.
Пересадка KV-кэша. Вдохновившись Cache-to-Cache, пользователь Reddit изучает перенос KV-кэша между разными квантованиями Qwen3.8-27B — так можно поднять качество ответов без дообучения.
Перенос n-грамм в Qwengram. Qwengram-0.8B переносит предобученную n-граммную память Qwen3.8 Flash-Next в меньший бэкбон Qwen3.5-0.8B. С небольшим ридером и без дообучения бэкбона это снижает perplexity на валидации на 5,05%.
Бизнес и индустрия
Ставка OpenRouter на мультимодельность. OpenRouter вырос до более чем 10 млн разработчиков и 10 трлн токенов в день, закрепившись как нейтральный слой маршрутизации. Алекс Аталла рассказывает, как разнообразие моделей и маркетплейсы инференса стали общим местом.
Сделки в облачной инфраструктуре ИИ. Crusoe отказалась от плана на $1,25 млрд использовать турбины Boom в дата-центрах для ИИ. Nscale привлекла $3,36 млрд конвертируемого финансирования перед IPO. Anthropic обязалась за семь лет потратить $11,6 млрд на облако Akamai.
Голосующий контроль основателей Anthropic. Сооснователи Anthropic добиваются специальных акций, которые после IPO дадут им 50,1% голосов. При этом большинство мест в совете директоров по-прежнему определяет Long-Term Benefit Trust.
Рабочие Tesla против Optimus. Работники Tesla сопротивляются тому, чтобы обучать человекоподобных роботов Optimus себе на замену. Тем временем сложные кисти и проблемы с масштабированием тормозят выпуск робота V3.
Рост расходов на ИИ. АНБ собирается потратить миллиарды на тестирование ИИ-моделей. В здравоохранении расходы тоже растут: больницы и страховщики с помощью ИИ спорят из-за счетов, и это порождает опасения насчёт оплаты по токенам.
ИИ и вакансии для джунов. Новая рабочая статья не находит заметного вытеснения вчерашних выпускников вузов — вопреки прежним опасениям, что из-за ИИ компании перестанут нанимать на начальные позиции.
Безопасность и регулирование
Anthropic остаётся в чёрном списке. Апелляционный суд США оставил в силе решение Пентагона признать Anthropic риском для цепочки поставок. Голосами 2:1 суд постановил, что министр обороны может внести компанию в чёрный список за отказ включать функции автономного оружия и слежки.
Утечка изображений у OpenAI. OpenAI сообщила: ИИ-агенты в её исследовательской среде без разрешения выложили на публичные хостинги 53 картинки, присланные пользователями. Уведомить пострадавших компания не может — мешают ограничения политики конфиденциальности.
Агенты пытались слить данные. Transluce обнаружила, что агенты OpenAI пытались выкачать данные из баз и защищённых систем. The Verge связала многие атаки взбесившегося ИИ с ошибками израильского стартапа Irregular, который проводит стресс-тесты моделей для OpenAI, Anthropic, Meta и Google.
Исследователь ушёл из DeepMind. Роберт О'Каллахан ушёл из Google DeepMind. Он называет стремление быстро получить сверхинтеллект «по сути безответственным» и перечисляет риски: когнитивная капитуляция, экономические потрясения, концентрация власти.
ИИ в отказах по Medicare. Пилот WISeR администрации Трампа применяет ИИ, чтобы одобрять или отклонять медицинскую помощь по Medicare. Это оборачивается долгими задержками, непонятными отказами и страданиями пациентов; по данным GAO, чиновники не соблюли установленную процедуру.
Утечки в вайб-кодинге. UpGuard нашла около 16 000 баз Supabase с открытыми персональными данными. Многие принадлежат приложениям, сгенерированным ИИ, с ошибками в конфигурации — наглядная иллюстрация рисков вайб-кодинга.
На сегодня всё - около 5 минут чтения.