Открытые и локальные релизы моделей
Открытое семейство Ornith-1.5. Ornith-1.5 выпущен в вариантах 9B dense, 35B MoE и 397B MoE под лицензией MIT с сильными показателями в агентных и кодовых бенчмарках; сообщество квантования показывает, что 35B работает со скоростью 60 токенов/с на 12GB 4070 Ti, а 9B превосходит более ранние маленькие модели.
Полевые отчёты Qwen3.8-27B. Локальные пользователи сообщают, что Qwen3.8-27B может автономно выполнять более 80 вызовов инструментов и обрабатывать длинные агентные цепочки, но его офлайн-знания и строгие оценки кодинга слабее, чем у предшественников, поэтому он лучше всего работает с чётким направлением или в режиме копилота.
Ускорение и квантование Qwen3.8. Усилия сообщества позволили разогнать Qwen3.8-27B до 138 токенов/с на RTX 3090 с DFlash2, выпущены кванты Dynamic V3, заявляющие о 10% повышении точности, глубинный прунинг до 22.7B Mini-Me и нативный FP4 на V100 2017 года, сопоставимый с 5090.
- → I pushed Qwen3.8-27B limits again... Dflash2 - 134 tps on a RTX 3090
- → DFlash2 speeds Qwen 3.8 27B up to 4 times
- → Introducing Qwen3.8-27B Dynamic v3 Unsloth GGUFs
- → updated unsloth/Qwen3.8-27B-GGUF · Hugging Face
- → Qwen3.8-23B-Mini-Me: A Depth-Pruned Qwen3.8-27B (to ~22.7BB)
- → NVFP4 on VOLTA! Despite being built for Blackwell, I made four 2017 V100s run Qwen 3.8 NVFP4 natively and match my $6000 RTX 5090.
Базовые контрольные точки Ling. AntLing открыл исходный код базовых и промежуточных контрольных точек для Ling-3.0-tiny и flash без пост-обучения, а пользователь использует Ling tiny в качестве вспомогательного инструмента для сжатия контекста вместе с Qwen3.8.
LFM2.5 QAD кванты. Liquid AI выпустил контрольные точки Q4_0, обученные с помощью дистилляции с учётом квантования, восстанавливающие 97% точности BF16 при той же скорости и памяти.
GLM-5.3 и передовые релизы. GLM-5.3 делит первое место с Kimi K3 в рейтингах открытых моделей, демонстрируя значительные улучшения в агентных задачах и более низкую стоимость, хотя открытые веса задержаны на две недели; также выпущены DeepSeek V4-Pro GA и NVIDIA Nemotron 3.5 Lightning/NeMo Switchyard.
Агентные инструменты и обновления продуктов
Безопасные песочницы. Саймон Уиллисон протестировал smolmachines/smolvm как песочницу для недоверенных Python и JavaScript с ограничениями по CPU/RAM и без сети; Джереми Моррелл утверждает, что расширения, написанные LLM, в сочетании с примитивами песочницы обеспечивают безопасное расширяемое ПО.
Replit Free Mode. Replit представил Free Mode на базе GPT-5.6 Luna, позволяющий любому создавать приложения и агентов без ограничений по стоимости токенов.
AI-заметки Calendly. Calendly внедрил ведение заметок на встречах с резюме, пунктами действий и грядущим ассистентом Callie, который использует контекст встречи для планирования последующих действий.
Meta AI Mac приложение. Meta запустила Mac-приложение для своего AI-чата с демонстрацией экрана, диктовкой и интеграцией с Google Workspace, чтобы конкурировать с настольными ассистентами Gemini, ChatGPT и Claude.
Обнаружение мошенничества на устройстве в WhatsApp. WhatsApp тестирует Scam Alert — опциональную модель на устройстве, которая классифицирует сообщения от не-контактов, используя конфиденциальную федеративную аналитику для сохранения приватности.
Инструменты для учёбы Google. Google выпустил студенческий хаб Gemini, интерактивные визуализации и викторины, созданные ИИ в Поиске, и Deep Research в Gemini Live к началу учебного года.
Alexa+ бесплатно на Fire TV. Amazon сделал Alexa+ бесплатным на Fire TV без Prime, автоматически развернув разговорный поиск, управление умным домом и AI-рекомендации.
Индустрия и бизнес
Stripe покупает OpenRouter. Stripe подтвердил приобретение OpenRouter за 7,5 миллиарда долларов, а основатели назвали 'сингулярность' причиной остаться частными и инвестировать в агентную инфраструктуру.
Отчёт о SpaceX-Cognition опровергнут. Bloomberg сообщил, что SpaceX пыталась приобрести Cognition, но генеральный директор Скотт Ву опроверг эту историю, заявив, что Cognition не продаётся и переговоров не было.
Лидерство Anthropic по выручке. Anthropic впервые обогнал OpenAI по квартальной выручке, достигнув 11,6 млрд долларов с небольшой операционной прибылью, в то время как 6,7 млрд OpenAI сопровождались более глубокими убытками.
Вычисления как класс активов. Nvidia работает с Apollo, BlackRock и другими над финансированием в размере 500 млрд долларов, чтобы рассматривать вычисления как инвестиционный актив; Silicon Data привлекла 30 млн долларов для запуска фьючерсов на GPU на CME.
Память и поставки чипов. Цены на DRAM выросли на 500% за 12 месяцев, и гиперскейлеры зарезервировали поставки на 2027 год; Китай разрешает небольшие партии H200 для ByteDance и Tencent, чтобы ослабить дефицит мощностей для инференса.
Инфраструктура центров обработки данных. TerraPower планирует проект дата-центра с использованием накопителей энергии своего реактора Natrium, а Relativity Networks привлекла 22 млн долларов для полого-core волокна, передающего данные на 50% быстрее.
Репутация ИИ ухудшается. Pew выяснил, что 52% американцев больше обеспокоены, чем воодушевлены ИИ, а местные сделки по дата-центрам сталкиваются с общественным сопротивлением.
Безопасность, конфиденциальность и защита
Приватная обработка безопасности OpenAI. OpenAI анонсировал Private Safety Processing для клиентов с нулевым хранением данных, обеспечивая обнаружение злоупотреблений во взаимодействиях без раскрытия содержимого персоналу; это контрастирует с политикой 30-дневного хранения у Anthropic.
OpenAI исправляет Codex и TAC. OpenAI выпустил защитные меры после того, как Codex удалил реальные пользовательские файлы из-за ошибочных команд очистки, и подтвердил, что отдельная ошибка временно отозвала доступ к программе Trusted Access for Cyber.
Эксплойты ICS, созданные ИИ. Американские агентства предупредили, что злоумышленники используют ИИ для создания эксплойт-скриптов для Siemens S7, снижая требуемые навыки и время для атак на промышленные системы управления.
Внутренний контроль в AI-лабораториях. Первая оценка Guidelight показала, что ни одна AI-компания полностью не применяет базовые внутренние контроли; Anthropic и OpenAI лидируют с оценкой C+, а xAI и Meta получили D- и F.
Дипфейк-реклама Meta. Meta разместила рекламу AI-приложения для 'раздевания' нацеленную на женщин-политиков, несмотря на политику, запрещающую сексуальные материалы.
Продажа данных сотрудников Spirit. Google выиграл аукцион по данным о сотрудниках Spirit Airlines; бывшие бортпроводники возражают, что конфиденциальность работников может не быть защищена от реидентификации.
OpenAI замедляет разработку. OpenAI приостановил некоторое RL-обучение и отложил фронтирные запуски, ужесточая меры безопасности, проверяя, может ли добровольное замедление работать без принятия во всей отрасли.
Исследования и анализ
Дизайн белков Claude. Модели Claude от Anthropic разработали мини-биндеры для 15 мишеней с частотой попаданий 26,8%, превзойдя типичные результаты ранних этапов разработки лекарств, хотя независимая проверка ещё не завершена.
Данные о тканях Vivodyne. Роботизированные лаборатории HIVE от Vivodyne выращивают 20 типов человеческих тканей и генерируют каузальные биологические данные для решения проблемы нехватки данных, которую компания видит в AI-открытии лекарств.
Миф о токенах рассуждений. Исследование оспаривает представление, что промежуточные токены LLM являются семантически значимыми рассуждениями; модели часто создают недопустимые трассировки даже при правильных ответах, и обучение на повреждённых трассировках всё ещё может работать.
Метрика продуктивности кодинга. Саймон Уиллисон утверждает, что строки отлаженного продакшн-кода остаются значимой метрикой продуктивности при использовании агентов кодинга, но достижение такого результата по-прежнему требует навыков старшего инженера.
На сегодня всё - около 5 минут чтения.