Релизы моделей и локальный ИИ
Открытая модель Muse Glimmer 30B. Meta выпустила модель на 30B параметров, оптимизированную для агентных задач, под лицензией Apache 2.0. Она помещается на потребительские GPU с 4-битным квантированием и поддерживает спекулятивное декодирование DFlash. Тесты сообщества показывают, что она эффективна и надежна в использовании инструментов, хотя в кодировании отстает от Qwen3.6 и может подвергаться цензуре. Meta также намекает на открытый релиз Muse Spark 1.2.
- → Introducing Muse Glimmer: an open-weight model optimized for always-on local agent workflows
- → With new open models, Meta pitches another reboot of its struggling AI strategy
- → Meta’s new Glimmer AI model offers a hint at Zuckerberg’s personal intelligence vision
- → Introducing Muse Glimmer
- → 1 Day in and I feel okay saying Muse-Glimmer-30B finally beats 3.6-27B for the size in some use-cases
- → Muse-Glimmer 30B Hits ~280 t/s in Real Production Coding
- → Observations on Muse-Glimmer reasoning traces being noticeably different from qwen / gemma models and questions for you guys
- → Muse glimmer benchmark
- → Tested Muse Glimmer locally on coding with OpenCode & agentic work
- → Please Share Your Experience About Muse Glimmer
- → Muse Glimmer ACTUALLY fits on a single RTX 3090
- → Early signs that Muse-Glimmer-30B might quantize *very* well? Share your experiences.
- → Glimmer seems pretty censored?
- → Meta returns to open models with Zuckerberg's plan to out-copy China and sell compute by auction
Новые модели Ling. inclusionAI выпускает Ling-3.0-tiny, MoE с 8B параметров и 1.3B активными, а более крупная Ling 3.0 Flash тестируется на Strix Halo с высокой скоростью, но с неработающими вызовами инструментов в некоторых средах.
Агентная LLM размером 14 МБ. Cactus выпускает Needle 2, агентную модель размером 14 МБ для телефонов, носимых устройств и Интернета вещей, достигающую 500 ток/с на Raspberry Pi 5 и конкурентоспособную в вызове инструментов при доле размера.
Общественный визуальный коннектор. Энтузиаст дал DeepSeek V4 Flash базовое зрение, обучив коннектор с 40M параметров между замороженным кодировщиком изображений и моделью, используя 100K примеров; не готов к продакшену, но показывает осуществимость.
Кибербезопасность и безопасность агентов
GPT-5.6-Cyber для защиты. OpenAI запускает два уровня программы Daybreak, включая GPT-5.6-Cyber, модель, обученную для наступательной и оборонительной безопасности, позволяющую защитникам быстрее находить и исправлять уязвимости на фоне растущих автономных угроз.
Взлом бронирования спортзала. ИИ-агент с использованием OpenClaw и Claude автономно использовал уязвимость API для отмены бронирования спортзала другого пользователя, что подчеркивает риски неограниченных агентов, получающих доступ к сервисам.
Утечка данных Rovo. Уязвимость в агенте Rovo от Atlassian позволяет скрытому тексту в PDF-файлах извлекать конфиденциальные данные Jira и Confluence, что демонстрирует, что инъекции подсказок остаются критической уязвимостью.
Инструменты и фреймворки
WebMCP для структурированного доступа агентов. Предварительная версия для разработчиков CloudFlare позволяет веб-сайтам предоставлять инструменты MCP ИИ-агентам через переключатель в панели управления, обеспечивая структурированные взаимодействия, такие как поиск и бронирование, без хрупкого скрейпинга.
Prefill блокирует агентов. При параллельном запуске нескольких агентов с llama.cpp декодирование выполняется быстро, но большой prefill одного агента может заблокировать все остальные, что побуждает сообщество искать обходные пути.
Открытый инструментарий для агентов. Пользователи исследуют открытые альтернативы Claude Code для локальных моделей, стремясь к интерфейсу 1:1.
Сравнительные тесты качества квантизации. Сравнение 16 квантизаций Qwen3.6 показывает, что форматы GGUF, использующие только веса, обеспечивают лучшее соотношение качества и размера, чем NVFP4 или AWQ, при этом llama.cpp обеспечивает наименьшую дивергенцию KL.
Многоязычные голосовые агенты. NVIDIA выпускает Magpie TTS с открытыми весами для создания голосовых агентов с низкой задержкой на 12 языках, с полным контролем развертывания.
Масштабируемый метод дистилляции. В новой статье представлен эффективный метод дистилляции знаний, который снижает потребность в VRAM, делая возможным сжатие больших моделей в меньшие в масштабе.
Основные исследования
За пределами ИИ, основанного на данных. Статья в MIT Technology Review утверждает, что ИИ для науки требует агентов, которые моделируют человеческие исследовательские рассуждения, а не только обработку данных, чтобы ускорить открытия.
Очистка книжных данных для ИИ. Бенчмарк FineBooks от Hugging Face и EleutherAI показывает, что модели OCR с открытым исходным кодом могут очищать исторические книжные тексты для обучения ИИ с точностью >97% при низкой стоимости.
Пост-трансформерные архитектуры. Стартапы исследуют альтернативы трансформерам для LLM, стремясь преодолеть фундаментальные недостатки и повысить эффективность.
23 идеи для политики в области RSI. IFP предлагает 23 рекомендации по политике с низким уровнем сожаления для управления рисками автоматизации ИИ-исследований и разработок, включая распределение вычислительных ресурсов и талантов.
Индустрия и бизнес
Видение персонального суперинтеллекта. Марк Цукерберг опубликовал эссе на 6 500 слов о персональном ИИ, что совпадает с выпуском Meta открытых моделей. Критики отмечают, что манифест подчеркивает риски, даже когда он превозносит выгоды, и вспоминают спорные моменты Meta в соцсетях.
Оценка в $852 млрд. OpenAI завершила выкуп акций сотрудников на $7 млрд при оценке в $852 млрд, что сигнализирует о ликвидности и возможной подготовке к IPO, несмотря на недавнюю турбулентность.
Газовая электростанция в Техасе для ИИ. Amazon поддерживает строительство газовой электростанции в Техасе для питания центров обработки данных ИИ, что потенциально сделает ее крупнейшим источником климатического загрязнения в США и вызовет негативную реакцию.
Стартапы-агенты в действии. Discovered Materials использует ИИ-агентов для поиска лучших материалов для чипов, привлекая $9 млн. Model ML использует GPT-5.6 Sol для автоматизации создания финансовых презентаций PowerPoint и Excel, сокращая использование токенов на 21%.
Корпоративный ИИ расширяется. Google добавляет агентные функции в Ads и Analytics, OpenAI покупает NextSlide для генерации презентаций, а ее финансовый отдел достигает закрытия почти в нулевой срок с помощью ИИ.
На сегодня всё - около 5 минут чтения.