Agentic AI News Сьогодні

Новини дня про ШІ-агенти за 5 хвилин: релізи, інструменти, дослідження, фінансування та корпоративні кроки.

Оновлюється щодня підібрано з 30 джерел Субота, Жовтень 3, 2026

Випуски агентів і моделей

Гаджети Muse. Meta виклала у відкритий доступ прошивку та SDK для створення DIY-пристроїв, як-от E Ink-дисплеїв і HDMI-стіків, що під’єднуються до її агента Muse. Підтримка — у Discord.

Dot від OpenAI. Новий агент Dot від OpenAI поводиться як корпоративне ПЗ, яке може ще й замовити вечерю: він працює у віртуальній машині з доступом до застосунків на кшталт Blender і GIMP. Його позиціюють як колегу, а не персонального шопера.

Гуманоїдна модель Unitree. Unitree випустила UnifoLM-WLA-1.0 — модель на 6B, натреновану на приблизно 2 500 годинах реальних даних робота. Вона виконує 64 завдання для всього тіла та настільних задач на G1, поєднуючи оптичний потік і MMDiT для безперервного керування.

FrogNano для коду. FrogNano-4B-2609 від Microsoft — агентна модель на основі Qwen3.5-4B, дотренована на 1 500 синтетичних SWE-завданнях із виконуваними винагородами, щоб покращити програмну інженерію на рівні репозиторію в компактному вигляді.

Clef від Cloudflare. Cloudflare випустила decision-моделі Clef і Clef-flash, які видають імовірності для наперед визначених відповідей. Медіанна затримка — всього 39 мс, тож агенти можуть діяти без людини в циклі.

Інструменти та фреймворки

Рушій MegaCapybara. Спеціалізований рушій інференсу для RTX 5090 та Qwen3.8 27B заявляє приблизно вдвічі вищу швидкість декодування, ніж NInfer: понад 500 токенів/с на одному потоці та 2000+ токенів/с на 12 агентах. Використовує динамічні ядра й керування кешем.

Оновлення llama.cpp. У llama.cpp додали підтримку decision-моделей, а також CUDA pull request, який об’єднує спільних експертів, щоб пришвидшити MoE-архітектури на кшталт Qwen 35B A3B.

Субтитри mlsubgen. Новий локальний інструмент створює субтитри 45 мовами повністю на вашій машині: визначає мову для кожного фрагмента, узгоджує два розпізнавачі мовлення через локальну LLM і надає перевагу наявним вбудованим субтитрам.

Дослідження та досягнення моделей

Архітектура пам’яті Spotlight. Spotlight від Percepta замінює attention на необмежену записувану пам’ять, яку модель індексує сама. Це відокремлює інтелект від знань, тож можливості можуть зростати без зміни ваг.

Оновлення GPT-6. OpenAI опублікувала посібник із сімейства GPT-6 і анонсувала оновлення DevDay: GPT-6.1 Sol, computer use для Agents API, хмарні середовища Codex і Decisions API.

Відкритий AstaBrief. Hugging Face відкрила код AstaBrief — малої моделі, натренованої спеціально для швидкої генерації наукових звітів із посиланнями. Вона має спиратися на докази й перевіряти результати.

Індустрія та бізнес

Apple обмежує доступ до диска. Apple посилює контроль у macOS Full Disk Access через ризики від ШІ-агентів — після того, як Meta Muse нібито читав повідомлення без дозволу. Meta каже, що доступ надається лише за згодою, а Apple хоче, щоб користувач явно підтверджував дію.

Опір дата-центрам. Amazon пообіцяла 1 млрд доларів громадам, де розташовані дата-центри, а CEO AWS Метт Гарман закликав припинити мораторії, назвавши це іноземною дезінформацією. Microsoft розширює біомімікрію в дата-центрах попри місцевий спротив.

ШІ стає «суперінтелектом». Білий дім домігся, щоб керівники великих технокомпаній підписали зобов’язання про безпеку ШІ, а Трамп підписав указ, який перейменовує ШІ на «суперінтелект». Водночас лише 2 % споживачів купують ШІ-продукти.

Безпековий скандал в OpenAI. OpenAI звільнила трьох дослідників, а четвертий пішов сам після розслідування, яке виявило, що вони злили конфіденційну інформацію зовнішній організації з безпеки ШІ.

Uber Eats пришвидшує пошук. Uber перебудував свій пошуковий пайплайн і скоротив наскрізну затримку на 50 %, застосувавши агентне кодування для визначення та перевірки оптимізацій.

ШІ-стратегія Airbnb. CTO Airbnb Ахмад Аль-Дахле застосовує стратегію ШІ «зсередини назовні»: використовувати генеративний ШІ всередині компанії, щоб пришвидшити розробку продуктів, а потім трансформувати клієнтський досвід.

Локальний ШІ та залізо

Strata і Qwen3.8 Next. Користувачі повідомляють, що Strata з Qwen3.8 Next видає 45–70 токенів/с на повільній системі DDR4 + 7900XTX і 150–200 токенів/с на обмеженій за потужністю RTX 5090 з 96 ГБ DDR5, суттєво випереджаючи llama.cpp.

iPhone як друга GPU. iPhone 17 Pro Max може прискорити prefill Qwen 3.8 27B на 29–44 % на MacBook із 24 ГБ, якщо підключити його через USB-C і запускати верхні шари на GPU телефона.

Картки Ascend 96 ГБ. Дві картки Huawei Atlas 300I Duo по 96 ГБ кожна можуть запускати Qwen3.8 Flash-Next зі швидкістю близько 30 токенів/с після налаштування програмного стека, хоча й не є прямою заміною CUDA.

Ціни DGX Spark і 5090. Nvidia представила 64-ГБ DGX Spark, тоді як ціна оригінальної 128-ГБ моделі зросла до $6 950. А для купівлі RTX 5090 у Micro Center тепер нібито потрібні документи про відсутність експорту.

Це все на сьогодні - приблизно 5 хвилин читання.

Читайте щоранку прямо у вашому браузері

Розширення відкриває цей дайджест у бічній панелі Chrome — один клік, без реєстрації.

Додати до Chrome — Безкоштовно