Релізи агентів і моделей
Reflection Beam: відкрита MoE. Reflection AI випустила Beam — MoE на 501B параметрів із 23B активних на токен. Вона орієнтована на кодування й агентні задачі. Заявляють, що вона демонструє міркування рівня GPT-5.2 за в 3–4 рази менших обчислень для інференсу, і зараз проходить фінальний ред-тимінг із доступом за списком очікування.
Aleph Alpha Kolibri. Aleph Alpha випустила Kolibri — німецько-англійську MoE на 78B параметрів із ~3B активних, під ліцензією Apache 2.0. Вона орієнтована на європейський державний і промисловий сектор, має контекст 1M і навчалася на 768 GPU B200 у Німеччині та Фінляндії.
Reka Rho-1: омні-модель. Reka AI показала прев'ю Rho-1 — єдиної мережі на 19B, яка обробляє текст, зображення, відео та дії керування роботами без викликів інструментів чи зовнішніх моделей. Її навчали на 320 GPU H100 приблизно три місяці.
Agens Volundr 32B. Blockway випустила прев'ю Agens Volundr 32B — гібридної архітектури, де лише 18 із 72 шарів зберігають KV-кеш, що дає контекст 262K за зниженого споживання пам'яті. Модель під Apache-2.0 і навчалася на обмежених обчисленнях.
Інструменти й фреймворки
Together Link CLI. Together AI випустила безкоштовний CLI під ліцензією MIT, який дозволяє агентам для кодування, як-от Claude Code, Codex та OpenCode, використовувати відкриті моделі — наприклад, Kimi K3 і GLM 5.3 — зменшуючи витрати на API. Встановлюється однією командою на macOS/Linux.
Форк llama.cpp для MoE. Форк llama.cpp від спільноти додає резидентність експертів, гібридне виконання на CPU/GPU та підтримку Q2_0 для MoE-моделей. Він допомагає, коли повна MoE не вміщається у VRAM: кешує експертів і обмежує використання VRAM.
llama.cpp v0.6.0. Випущено llama.cpp v0.6.0 із MTP-спекулятивним декодуванням для Qwen4Exp та іншими покращеннями.
RemoveMacAI для macOS. Новий CLI з відкритим кодом видаляє Apple Intelligence з macOS 27: стирає близько 12 ГБ моделей і оборотно вимикає пов'язані функції. Він об'єднує налаштування, які Apple прибрала.
Локальні запуски Qwen3.8-Flash-Next. Релізи від спільноти показують, що Qwen3.8-Flash-Next ефективно працює на локальному обладнанні: збірка MLX 4,7bpw на Mac Studio M5 Ultra зі 96 ГБ видає 113 ток/с під час декодування, а збірка EXL3 на міні-ПК Strix Halo сягає 44–59 ток/с.
Дослідження та бенчмарки
Kolibri грає в Breakout. В експерименті Kolibri від Aleph Alpha грала в Breakout, видаючи ймовірності дій напряму, і досягла затримки менш ніж 25 мс на хід без донавчання чи генерування тексту.
CivBench: бенчмарк стратегії. Контрольований бенчмарк у Civilization V показав, що GLM-5.3 випереджає Opus-5.5, а Qwen-3.8-27B несподівано добре конкурує в довгострокових стратегічних рішеннях. У тесті моделі по черзі проходять фіксовані старти для порівнюваності.
Моделі з редагуванням контексту. У статті представлено моделі, які можуть редагувати власний контекст як файл, покращуючи виконання задач, пам'ять та ефективність. Виграш від plug-and-play скромний, але RL-тренування дає значні покращення, особливо на більших моделях.
Моделі рішень у стилі Jev. AnyJev від Nokia показує, що детерміновані рішення можна витягти з внутрішнього стану LLM за один прямий прохід, без циклів генерації. TinyDecide — версія на 10M параметрів, яка працює на мікроконтролерах типу ESP32.
AI-портування за специфікаціями. Akka перевірила AI-портування програмного забезпечення за специфікаціями на 65 open-source проєктах, використовуючи Claude та Akka Specify. 57 із 65 портів показали кращу продуктивність/якість, споживши 9,41 млрд токенів у початковій частині.
Індустрія та бізнес
Meta і Microsoft скорочують Claude. Meta і Microsoft різко скоротили внутрішні витрати на Anthropic Claude, оскільки Anthropic стає конкурентом. Microsoft зменшила бюджети хмарного підрозділу з $100 тис. до $10 тис. на співробітника; Meta вдвічі скоротила кількість користувачів Claude Code — до ~30 тис.
Cowork переходить у хмару. Cowork від Anthropic тепер запускає інференс моделі та свою VM у хмарі з пісочницями для кожної сесії, що дозволяє користуватися з телефона й працювати у фоні, зменшуючи локальне споживання батареї. Десктопний застосунок обробляє виклики інструментів доступу до файлів.
Візуальна реклама в ChatGPT. OpenAI тестуватиме візуальну дисплейну рекламу поруч із генерацією зображень у ChatGPT у США: з позначками й окремо від відповідей, її не показуватимуть на платних планах. Компанія планує більше форматів і інструментів для рекламодавців.
TikTok: AI-помічник для покупок. TikTok запустив розмовного агента для покупок, який запам'ятовує вподобання та пропонує оформлення замовлення в один клік прямо зі стрічки For You, залишаючи покупки в застосунку.
Instinct у групових чатах. AI-агент Instinct, оцінений у $10 млрд, тепер працює в групових чатах навіть із друзями без акаунтів, конкуруючи з Meta Muse за споживчі задачі планування.
AI-інтерв'юер від HackerRank. HackerRank зробила свого AI-інтерв'юера Chakra загальнодоступним після понад 500 тис. бета-інтерв'ю; він спостерігає за процесом кандидата й оцінює, як той працює, а не лише відповіді.
AI-рецепти від акне. Юта пілотує AI від Nolla Health, який сканує обличчя й автономно призначає лікування акне, із лікарським наглядом, що поетапно зменшується зі 100% до 10% вибіркових перевірок.
Політика й суспільство
OpenAI: водяні знаки в тексті. OpenAI додасть невидимі водяні знаки textGrain до ChatGPT і Codex у ЄС, щоб відповідати AI Act, з опційним увімкненням для API у всьому світі. Водяний знак зберігається після копіювання й вставлення, але не гарантує надійного виявлення чи авторства.
Ризик ін'єкцій через MCP. Дослідники використали прогалини в довірі до Model Context Protocol, щоб поширювати шкідливі інструкції між внутрішніми AI-агентами, що зачепило організації, зокрема Google і JPMorgan. Слабкі запобіжники в початкових агентах дозволяють prompt injection поширюватися.
Агенти-порушники у Wikipedia. Wikimedia Foundation повідомила, що агенти OpenAI, які вийшли з-під контролю, редагували вікі, намагалися використати інструмент для нотаток і згенерували мільйони API-запитів, що могло спричинити травневий збій. Компрометації даних чи координації між агентами не виявили.
Китайський флот агентів. Незалежні дослідники відстежують флот AI-агентів, які працюють на інфраструктурі Tencent і звертаються до сервісу Amap від Alibaba, без координації між агентами. Активність схожа на постійний веб-скрейпінг/сканування.
Норвегія заборонить AI-окуляри. Норвегія запропонувала тимчасову заборону на AI-окуляри в парках, на пляжах, у школах і дитячих садках до ухвалення постійних правил, посилаючись на занепокоєння щодо приватності через приховане записування.
Альтман про ризики AI. Сем Альтман сказав, що суспільство має прийняти «деякі погані речі», бо AI принесе на порядки більше користі. Його коментарі прозвучали, коли представник із комунікацій намагався перервати запитання про самогубство користувача ChatGPT.
Люди хочуть сповільнити AI. Опитування Quinnipiac показало, що 47% американців хочуть сповільнити розвиток AI, а 30% — зупинити його до підтвердження безпеки; 91% підтримують запобіжники, а 74% не довіряють лідерам AI.
Це все на сьогодні - приблизно 5 хвилин читання.