Agentic AI News Сьогодні

Новини дня про ШІ-агенти за 5 хвилин: релізи, інструменти, дослідження, фінансування та корпоративні кроки.

Оновлюється щодня підібрано з 30 джерел Середа, Вересень 2, 2026

Релізи агентів і моделей

Claude Fable 5.1. Anthropic випустила Fable 5.1 і Mythos 5.1, заявляючи про кращі результати в програмуванні та дослідженнях і до 45% нижчу вартість агентної роботи завдяки дешевшому читанню кешу. Необмежена Fable 5.1 уже доступна, хоча перші аналізи витрат ставлять під сумнів максимальну економію на найвищому рівні міркувань.

Запуск OpenAI Astra. OpenAI заявляє, що її майбутня модель Astra — перша LLM, яка досягла критичного порогу кібербезпеки компанії: вона здатна самостійно знаходити та використовувати невідомі вразливості. Після зламу Hugging Face компанія відклала частину роботи над Astra, щоб посилити захист, і обмежить доступ до найсучасніших можливостей кібербезпеки.

Нові Spark-X2.5. Відкриті моделі Spark-X2.5-4B і 1.7B з’явилися на Hugging Face із новою архітектурою. Заявлено, що за продуктивністю вони конкурують із Qwen 3.5 9B і мають нативний контекст 1M. Вони поки що не працюють в основній гілці llama.cpp, але для них є окремий форк.

Runway Solaris: інтерфейсна модель. Runway представила Solaris — «інтерфейсну світову модель» (Interface World Model), яка замість виконання коду генерує кадри UI в реальному часі й реагує на кліки та голос. Поки що це дослідницький проєкт з обмеженнями у відтворенні тексту та підтримці скрінрідерів.

Локальний ШІ та залізо

Qwen3.8 локально. Звіти спільноти показують, що Qwen3.8 27B і Flash-Next працюють на різному залізі: 12 ток/с на Mac із 48 ГБ пам’яті, декодування зі швидкістю 280 ток/с на двох Epyc R9700 із MXFP4-ядрами та 132 ток/с декодування на одній RTX 3090 після кастомної оптимізації. Бенчмарки квантування свідчать, що UD Q3_K_XL добре підходить для відеокарт із 16 ГБ пам’яті. Водночас деякі користувачі вважають, що Qwen3.8 добре пише код, але надто охоче вносить правки.

Подорожчання DGX Spark. DGX Spark від Nvidia та Asus Ascent GX10 помітно подорожчали: модель Asus стрибнула в ціні з $3999 до $5999. Покупці питають, чи виправдані кластери DGX Spark порівняно з системами на AMD Epyc, які мають більшу пропускну здатність пам’яті, хоча DGX підтримує FP4 і тензорний паралелізм.

Відмови CMP 170HX. Один користувач повідомляє, що 2 із 5 графічних процесорів CMP 170HX вийшли з ладу протягом двох тижнів, а ще в одного виявили дефектні тензорні ядра. Він стверджує, що поточні ціни не виправдовують такого ризику для інференсу LLM.

INT8 та оманливі кванти. У спільноті питають, чому INT8 W8A8-моделі не поширеніші на RTX 3090, якщо ці карти мають нативні INT8-ядра для тензорних обчислень. Водночас інший користувач звинувачує AtomicChat у тому, що той позначив IQ2_S-квант як Q4_K_M.

Амбіції Intel у пам’яті. Intel натякнула, що може повернутися на ринок пам’яті: CEO компанії згадав про найм колишнього топменеджера SK Hynix Сок-Хі Лі та про нову архітектуру пам’яті. Деталей поки що обмаль.

Інструменти та фреймворки

OpenClaw 2.0: реліз. OpenClaw 2.0, відкритий персональний AI-агент, спростив налаштування: він самостійно виявляє наявні підписки ChatGPT/Claude та локальні моделі. Він також робить браузер своїм основним інтерфейсом. Додано спільні хмарні сесії для командної роботи.

Codex: локальні інструменти. Десктопний застосунок Codex від OpenAI тепер містить повну інсталяцію LibreOffice та інші бінарники, зокрема Poppler і git, у своєму runtime. Це дає змогу обробляти документи без зовнішніх залежностей.

AI-фабрики програм. Провідні open source AI-проєкти, зокрема Flue і tldraw, відхиляють зовнішні PR. Натомість команди агентів сортують, відтворюють, виправляють і перевіряють issues. У проєкті AI SDK від Vercel розгорнули мультиагентну «фабрику програмного забезпечення», щоб скоротити беклог із понад 1000 issues і 800 PR.

Terraform для агентів. HashiCorp позиціонує HCP Terraform як контрольну площину з governance для AI-керованої інфраструктури: агенти можуть створювати й застосовувати зміни Terraform, а політика, ідентичність та аудит лишаються під контролем.

datasette-mcp: оновлення. Плагін datasette-mcp отримав версію 0.2: результати SQL-запитів тепер повертаються як об’єкти, а не масиви. Так слабшим моделям легше правильно зіставляти колонки.

Дослідження та безпека

BenchMIRT: аудит бенчмарків. Hugging Face представила BenchMIRT — метод аудиту LLM-бенчмарків на рівні окремих промптів. Він показує, що промпти в межах одного бенчмарка можуть вимірювати різні здібності, а середні бали це приховують.

Агентне відео Gemini. Google DeepMind запустила агентне розуміння відео в Gemini 3.7/3.6/3.5 Flash-Lite. Модель за допомогою нативних відеоінструментів динамічно шукає та перевіряє відеофрагменти. Це підвищує точність і зменшує витрату токенів на аналіз відео.

Водяні знаки Claude. Anthropic відкрила свій API перевірки водяних знаків для регуляторів, медіа та фактчекерів. Схвалені організації зможуть виявляти текст, згенерований Claude, за статистичною закономірністю, яка може зберігатися після деякого редагування. Цього вимагає EU AI Act.

Вибори та упередженість. За даними AlgorithmWatch, виборчі AI Overviews від Google суперечливі: вони спираються на обмаль джерел і часом описують кандидатів із партійним ухилом. Окремо ШІ-пошук Google радив телефонувати в екстрені служби залежно від національності, що спонукало до виправлень.

Індустрія та бізнес

Стрімкий зліт AfterQuery. AI-стартап AfterQuery, що готує дані для навчання, за повідомленнями, залучив інвестиції за оцінки $3,2 млрд — за п’ять місяців вона зросла вдесятеро. Це зробило його найшвидшим єдинорогом в історії Y Combinator. Компанія наймає професіоналів, які вчать моделі виконувати завдання на професійному рівні.

AIR: $50 млн. AI-стартап із кібербезпеки AIR вийшов зі стелсу з $50 млн. Він допомагає компаніям виявляти агентів і постійно перевіряти їхні скіли, MCP-сервери та додатки, блокуючи несанкціоновану взаємодію програм.

Google залицяється до Голлівуду. За повідомленнями, Google шукає ліцензійні угоди з великими студіями, щоб навчати AI-моделі на контенті, захищеному авторським правом, і пропонує великі виплати. Аналітики застерігають, що такі угоди можуть зашкодити публічній репутації студій.

Фокус на frontier AI. Новий керівник Google DeepMind Корай Кавукчуоглу заявив, що лідерство у frontier AI — єдине, що має значення. Він визнав, що нинішні моделі трохи не дотягують до рівня frontier, але пообіцяв закрити розрив. Конкретних новин про Gemini 4 або 3.5 Pro він не озвучив.

Агенти в бізнес-процесах. Дані Enterprise Signals від OpenAI показують, що передові компанії генерують у 8,3 раза більше вихідних токенів на активного користувача. Приклад — стартапи Basis, Clay та Exa Labs, які вбудовують агентів в онбординг, управління акаунтами та інтеграції для розробників.

Судовий конфлікт Apple і OpenAI. Apple домагається прискореного розкриття доказів у справі проти OpenAI, стверджуючи, що OpenAI не перевірила MacBook колишнього працівника Apple, на якому зберігалися обговорення знищення криміналістичних даних.

Google Pics: дизайн-інструмент. Google запустила Google Pics — AI-інструмент для створення та редагування зображень у Workspace на основі моделі Nano Banana. Він конкурує з Canva та Adobe Express завдяки створенню за текстовими запитами й точному редагуванню об’єктів.

Споживчі AI-агенти. Fambot представив AI-chief of staff для сімей, який бере на себе логістику. John Deere запустила AI-асистента JD для фермерів, що працює з їхніми даними. Amazon додала в Alexa сповіщення про покупки «Update Me When».

Це все на сьогодні - приблизно 5 хвилин читання.

Читайте щоранку прямо у вашому браузері

Розширення відкриває цей дайджест у бічній панелі Chrome — один клік, без реєстрації.

Додати до Chrome — Безкоштовно