Релизы моделей и бенчмарки
Gemini 3.8 Flash. Google выпустил уже третью модель Flash за шесть недель: улучшены рассуждения, написание кода и агентное использование инструментов. Цена за токен не изменилась, но модель может потреблять больше токенов; вариант Cyber доступен доверенным защитникам через новую программу Fairwind.
- → Google releases Gemini 3.8 Flash, its third Flash model in six weeks
- → Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
- → Proactive cyber defense for governments and enterprises
- → Proactive cyber defense for governments and enterprises
- → Gemini 3.8 Flash is Google's third budget model in six weeks while frontier models remain MIA
- → Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost more
- → llm-gemini 0.34
Muse Spark 1.3. Модель Meta с открытыми весами теперь занимает третье место на AAII, показывая тот же результат, что и GPT-5.6-Sol. При согласии пользователей обучение обходится более чем на 90% дешевле. Обещана публикация открытых весов; пользователи ждут более компактных вариантов между Glimmer и Spark.
GLM-5.3 против DeepSeek-V4. Пользовательские сравнения на Mac Studio и DGX Spark показывают, что GLM 5.3 Flash быстрее приходит к ответу, лучше пишет тексты и понимает изображения, а DeepSeek V4 Flash выдает больше токенов в секунду и имеет более длинный контекст. Для DeepSeek-V4-Flash-Vision-Exp теперь доступны поддержка изображений и GGUF.
Локальный ИИ и open source
Тюнинг Qwen3.8 Flash Next. Пул-реквест Expert cache ускоряет декодирование с 17 до 25–29 токен/с на двух 3090, а новые AP-квантования и подключение Q8 N-gram не снижают скорость. Пользователи также сообщают о галлюцинациях в планах и повреждении контекста — что типично для превью.
Perplexity Lily. Perplexity открыла исходный код своего Mac-сервера для инференса, оптимизированного под Qwen 3.6 на Apple Silicon. Проект сфокусирован на одной модели ради максимальной производительности.
Локальные речевые инструменты. В VoxGen добавлена поддержка Rust/Vulkan TTS для VoxCPM2 с плавной работой на AMD; Microsoft выпустила потоковую ASR-систему VibeVoice; пользователи описывают связку Mac Parakeet и Whisper/Parakeet как рабочий вариант STT для программирования.
Мод Minecraft от GLM. Локальная модель GLM 5.3 Flash Q4 на четырех видеокартах RTX PRO 6000 итеративно собрала мод для Minecraft с винтовкой, стреляющей чёрными дырами, используя Fabric API.
Исследования и модели мира
World Labs Atlas. Компания World Labs представила Atlas — единую модель, которая генерирует, восстанавливает и симулирует 3D-сцены всего по нескольким фотографиям, используя пространственный контекст, чтобы привязать каждый вход к 3D-пространству.
Языковое управление H3-World. H3-World превращает действия персонажа и камеры в текстовые инструкции, которые подаются через текстовый канал MiniMax-H3, что обеспечивает управляемое движение в игре при использовании всего 8 000 примеров и 0,199% обучаемых параметров.
Безопасность, политика и право
Astra: опасения по безопасности. Будущая модель OpenAI Astra использует непрозрачные рекуррентные механизмы, из-за чего цепочку рассуждений сложнее отслеживать; её кибервозможности оценены как «critical». Эксперты по безопасности предупреждают о гонке на дно.
Минюст США поддержал fair use. Правительство США встало на сторону OpenAI в иске The New York Times, заявив, что обучение LLM на охраняемых авторским правом текстах — это fair use и не равно их выдаче. Такая позиция призвана сохранить лидерство США в ИИ.
Секретные правила безопасности ИИ. Иск требует от администрации Трампа раскрыть засекреченную процедуру предрелизных проверок безопасности передовых моделей ИИ — сейчас она не прозрачна ни для публики, ни для Конгресса.
Запрет ИИ для школьников Нью-Йорка. Нью-Йорк запретил ИИ ученикам до восьмого класса включительно, а чат-ботов-компаньонов — во всех классах; в старшей школе использование ограничено и введены занятия по ИИ-грамотности.
Иски о стрельбе в Tumbler Ridge. Тридцать новых исков обвиняют OpenAI в пособничестве стрельбе в школе Tumbler Ridge. Истцы утверждают, что компания проигнорировала сигналы безопасности о переписке подозреваемого в ChatGPT.
Бизнес и корпоративный сегмент
Palo Alto покупает Console. Palo Alto Networks заплатила $500 млн за стартап ИИ-агентов Console, который автоматизирует задачи ИТ-поддержки. Покупка призвана добавить платформе Cortex возможность автономно решать задачи безопасности.
HiddenLayer привлекает $100 млн. Стартап HiddenLayer, специализирующийся на безопасности ИИ, привлек $100 млн: компании все больше тратят на защиту ИИ-моделей, агентов и рабочих процессов от состязательных атак.
Wonderful оценили в $5 млрд. AI OS-стартап Wonderful привлек $550 млн, удвоив оценку до $5 млрд. Компания расширяется от агентов поддержки клиентов до координации рабочих процессов в 35 странах.
Масштабирование корпоративных агентов. Schneider Electric, Vodafone и monday.com построили инфраструктурные уровни для наблюдаемости, оценки и развёртывания агентов после того, как выяснили, что агентов легко прототипировать, но сложно эксплуатировать.
Alexa: распознавание мошенничества. Amazon Alexa for Shopping теперь умеет сверять сообщение с записями Amazon об отправленных сообщениях и подтверждать его подлинность, помогая пользователям замечать мошенников, выдающих себя за других.
На сегодня всё - около 5 минут чтения.