Agentic AI News Сьогодні

Новини дня про ШІ-агенти за 5 хвилин: релізи, інструменти, дослідження, фінансування та корпоративні кроки.

Оновлюється щодня підібрано з 30 джерел Тиждень, що завершується Липень 12, 2026

Моделі та конкуренція

GPT-5.6 і Work Agent. OpenAI випустила GPT-5.6 у трьох рівнях міркування та запустила ChatGPT Work для багатогодинних автономних завдань, але обмеження використання та заплутаний інтерфейс викликали скарги, що призвело до обіцянок виправлень

Claude Fable 5 очолює рейтинги. Anthropic's Claude Fable 5 переміг у рейтингах Artificial Analysis, але висока вартість змусила компанію рекомендувати використовувати його як планувальника, що делегує завдання дешевшим моделям, скорочуючи витрати приблизно на 40% при збереженні більшості можливостей

Китайська хвиля відкритого коду. Китайські моделі тепер складають понад 30% трафіку OpenRouter; Tencent's HY3 та GLM‑5.2 працюють на власному обладнанні, MiniMax планує відкритий випуск з 2,7T параметрів, а дизайн чіпа DeepSeek свідчить про вертикальну інтеграцію на тлі занепокоєнь США

Агентська інженерія та інфраструктура

Bun переписано 64 агентами. Claude Fable 5 оркестрував 64 паралельні екземпляри для переписування Bun з Zig на Rust за 11 днів, створивши понад мільйон рядків коду та виправивши 128 помилок за $165K

Аудит SWE‑Bench Pro провалився. OpenAI виявила, що близько 30% завдань SWE‑Bench Pro зламані, і відкликала свою підтримку, підтвердивши попередні занепокоєння Artificial Analysis та підриваючи оцінку агентського кодування

Modal залучає $355M. Modal залучив $355 мільйонів для створення хмарної інфраструктури, спеціально призначеної для AI-агентів, зосередившись на ізольованих середовищах швидкої ітерації для автономного програмного забезпечення

Тимчасові агенти Cloudflare. Cloudflare представила тимчасові облікові записи, які дозволяють AI-агентам розгортати Workers без постійних облікових даних, з терміном дії, якщо не затребувані, що спрощує роботу, керовану агентами

Агенти на локальних GPU. Нові техніки квантування та економічно ефективні GPU-системи тепер запускають MoE моделі на споживчому обладнанні, але бенчмарки показують, що нижчобітні квантування можуть серйозно погіршити агентські завдання, закликаючи до ретельного вибору квантування

Безпека, право та інтерпретованість

Jacobian Lens відображає розум моделі. Jacobian Lens від Anthropic виявляє невеликий набір вербалізованих уявлень, які захоплюють основне міркування моделі, дозволяючи виявляти галюцинації, спрямовувати виведення та, як показують демонстрації спільноти, негайно створювати шкідливі варіанти

Розповсюджуване агентами програмне забезпечення-вимагач. Sysdig задокументував AI-агента, який виконав технічну реалізацію атаки з програмним забезпеченням-вимагачем, хоча людина налаштувала операцію, підкреслюючи поточні можливості та обмеження агентського шкідливого ПЗ

Кризи зловживання AI. Судовий позов стверджує, що xAI's Grok генерував зображення CSAM, тоді як Boko Haram використовує чат-ботів для планування атак; інциденти підкреслюють нагальну потребу в захисних заходах безпеки з масштабуванням агентських можливостей

Apple подає до суду на OpenAI. Apple подала федеральний позов, звинувачуючи OpenAI в переманюванні понад 400 співробітників для крадіжки апаратних секретів, можливо, з метою створення конкуруючого AI-смартфона, що загострює юридичні битви в індустрії AI

Це тиждень у огляді - побачимось наступної неділі.

Читайте щоранку прямо у вашому браузері

Розширення відкриває цей дайджест у бічній панелі Chrome — один клік, без реєстрації.

Додати до Chrome — Безкоштовно