Релизы агентов и моделей
Qwen 3.8 27B набирает баллы. Qwen 3.8 27B набирает 52 балла в Artificial Analysis Intelligence Index, соответствуя GPT-5.6 Luna Max и отставая на одно очко от значительно более крупных GLM-5.2 и DeepSeek V4 Pro. Он поставляется с режимом рассуждения xhigh по умолчанию, вероятно, для максимальной видимости в бенчмарках.
Qwen для агентного кодинга. При 16 ГБ VRAM квантованный Qwen 3.8 27B с MTP-спекулятивным декодированием обрабатывает контекст 73k при 30-50 tps. Локальные бенчмарки показывают, что режим среднего рассуждения почти соответствует DeepSeek V4 Flash с меньшим количеством токенов, в то время как xhigh не дает явного улучшения в агентном кодинге.
- → Optimizing Qwen3.6 / Qwen3.8-27B on 16GB VRAM: Complete Benchmark Results and Setup Guide (~30-50tps at 32k to 72k context)
- → After pushing 1M+ tokens through Qwen 3.8 27B, here is my optimal llama.cpp config for 16GB VRAM (73k Context, Agentic Coding)
- → Local agentic coding Benchmark : Qwen 3.8 27B (in many weights quants / cache quants / engine / reasoning effort) vs others.
35B-A3B по-прежнему неясно. Разработчик Qwen говорит, что не стоит ждать 35B-A3B, даже несмотря на высокий спрос сообщества на 35B-A3B и 122B, при отсутствии официальных сигналов о выпуске.
Скорость Ling 3.0 Tiny. Ling 3.0 Tiny 8B с 1,3B активных параметров работает со скоростью 36 токенов/сек на 4 ГБ VRAM и показывает результаты, близкие к Qwen 3.5 9B и Gemma 12.
Пост-обучение GLM-5.3. Z.ai выпустила GLM-5.3, улучшение которого достигнуто исключительно за счет дополнительного пост-обучения, что дает лучшую производительность в сложном кодинге и долгосрочных задачах.
Агенты Grok Bot. SpaceXAI представила Grok Bot — постоянных ИИ-агентов на выделенных облачных компьютерах, которые выполняют многошаговые рабочие процессы, запоминают предпочтения и координируют действия в группах.
Инструменты и фреймворки
llama.cpp v0.1.0. llama.cpp выпустил свою первую семантическую версию v0.1.0, а PR добавляет адаптивный MTP, который динамически выбирает глубину MTP, улучшая генерацию кода на 10-15% и ускоряя поиск до 100%.
Платежное промежуточное ПО для агентов. Промежуточное ПО AgentCore Payments для агентов LangChain добавляет детерминированные бюджеты на уровне сессий и поддержку кошельков, а LangSmith записывает, что и почему покупали агенты.
Агентные фитнес-функции. В новой статье утверждается, что агентные фитнес-функции могут расширить эволюционную архитектуру, обрабатывая риски, требующие экспертного суждения, в то время как детерминированные шлюзы остаются для измеримых инвариантов.
Планирование GPU с учетом ограничений. Hugging Face создала распределитель GPU, учитывающий ограничения, который повысил утилизацию до 33 процентных пунктов и приоритетно-взвешенную производительность до 105% на том же оборудовании.
Индустрия и бизнес
Сделка Stripe и OpenRouter. Stripe, как сообщается, приобретет стартап OpenRouter по маршрутизации ИИ-моделей более чем за 7 миллиардов долларов после его раунда B на 1,3 миллиарда; у OpenRouter 8 миллионов пользователей и 250 триллионов токенов в месяц.
Скачок выручки Anthropic. Годовой темп выручки Anthropic превысил 65 млрд долларов в июле, по сравнению с 47 млрд в мае и 9 млрд в конце 2025 года, а IPO ожидается этой осенью при оценке более 2 трлн долларов.
Relay закрывается. Стартап Relay по автоматизации рабочих процессов ИИ закрывается; его основатель и некоторые сотрудники присоединяются к команде Google Chrome для работы над ИИ в Chrome.
Wispr привлекает $280M. Wispr привлек 280 миллионов долларов в раунде B при оценке в 2 миллиарда долларов, чтобы расшириться с ИИ-диктовки на заметки и встречи, запустив модель Canto.
Восстановление рынка ИИ-видео. ИИ-генерируемое видео привлекает голливудские студии и миллиарды после неудачного старта Sora; такие стартапы, как Promise, используют Seedance 2.5 для фонов в реальном времени.
ИИ-агенты Grab. Grab сократил механическую аналитическую работу с 44% до 30%, используя пятиуровневую модель автономии агентов, при этом окончательные решения остаются за аналитиками.
Инфраструктура и вычисления
Дата-центр OpenAI в Огайо. OpenAI подписала 20-летнюю аренду на 8 ГВт ИТ-мощностей в PORTS-Pike в Огайо с SB Energy; Nvidia оказывает поддержку в размере до 105 млрд долларов и является единственным поставщиком чипов.
Неоклауд-разворот Groq. Groq привлек 350 миллионов долларов при оценке в 3,5 миллиарда долларов, переходя от ИИ-чипов к эксплуатации неоклауд-инфраструктуры на базе Nvidia после лицензионного соглашения с Nvidia.
Скачок цен на RTX Pro 6000. CDW повысила рекомендованную розничную цену RTX Pro 6000 с 16 до 19 999 долларов, и цены на вторичном рынке также резко растут, что оказывает давление на локальных разработчиков ИИ.
Обучающие данные и политика
Сканирование редких книг Amazon. AirTag отследил массовый заказ редких книг до объекта Amazon для обучения ИИ, где работники уничтожают книги для сканирования; Amazon заявляет, что покупает книги через коммерческие каналы.
Водяные знаки Anthropic Claude. Anthropic внедрит водяные знаки SynthID-Text в выходные данные Claude для соответствия EU AI Act; критики беспокоятся о качестве выбора слов и проблемах с прозрачностью.
На сегодня всё - около 5 минут чтения.