Моделі та релізи з відкритими вагами
Gemini 4 Argon. Google представила Gemini 4 Argon — нову фронтирну модель із найкращими показниками в програмуванні, роботі зі знаннями та кібербезпеці. Спершу її розгортають для довірених кіберзахисників у межах програми Fairwind, а вже зараз вона працює у внутрішніх процесах Google, зокрема в масштабних переходах із C++ на Rust. Вступна ціна API — $2/$10 за мільйон вхідних і вихідних токенів.
- → Google releases Gemini 4 Argon, called its most powerful model yet
- → Google Gemini 4 Argon closes the gap with OpenAI and Anthropic but doesn't take a clear lead
- → Google announces Gemini 4 and says it’s so capable that only ‘trusted cyber defenders’ can have it right now
- → Google announces Gemini 4 Argon AI model, but you can't use it yet
- → Gemini 4 Argon: our next era of frontier intelligence
Файнтюни Victoria і Maple. Дослідники випустили два файнтюни Qwen3.8-Flash-Next з відкритими вагами: Victoria — 48-гігабайтну модель для коду та агентних задач, що показує 70% на Terminal-Bench 2.1, і Maple, яка за замовчуванням звертається до канадських джерел і посилається на офіційні канадські джерела у 62,9% випадків проти 6% до файнтюну. GGUF-версії також додаються.
Багатомовна Index-Translate. Команда BiliBili Index LLM відкрила код Index-Translate: підтримка 150 текстових мов, варіанти на 2B, 9B і 35B-A3B, а також переклад документів і багатомовні субтитри та дубляж. Ваги й код — під ліцензією Apache-2.0.
Ling-3.1-flash. Китайська лабораторія Ling випустила Ling-3.1-flash — MoE-модель із ~560B загальних параметрів, ~25B активних параметрів на токен і контекстом до 1M. Два тижні нею можна користуватися безкоштовно, після чого модель відкриють. Заявлені результати: 1 673 Elo на GDPVal-AA v2.1, 75,16 на FrontierSWE і 65,35 на HealthBench Professional.
Агенти та computer use
Decisions API від OpenAI. OpenAI представила Decisions API, який змушує її модель Luna обирати з наперед заданих варіантів, завдяки чому рішення ухвалюються швидко й дешево — схоже на Jev від TypeSafe. API покликаний допомогти керувати роями агентів. А Арі Вайнштейн зі Sky розповідає, як computer-use агенти тепер поєднують скриншоти з даними DOM і Playwright і вміють відновлюватися після збоїв, що робить їх значно надійнішими, ніж кілька місяців тому.
Текстові замовлення в DoorDash. DoorDash запустила AI-агента, якому можна написати в Apple Messages, щоб зробити замовлення, узгодити дієтичні побажання групи та отримати рекомендації місцевих ресторанів. Лист очікування відкрито для США, паралельно тривають тести доставки дронами в Північній Каліфорнії.
Дизайн-агенти Flow Engineering. Flow Engineering залучила $50 млн у раунді Series B за оцінки $750 млн на AI-агентів, які узгоджують CAD-креслення з вимогами до продукту та результатами симуляцій. Серед клієнтів — Anduril, Rivian, Joby Aviation і GM PPU.
Restate залучила $20 млн. Restate залучила $20 млн на інфраструктуру довготривалих воркфлоу, яка добре пасує тривалим і непередбачуваним процесам AI-агентів. Компанія вже уклала кілька контрактів на суми в шість і сім цифр і витратить залучені кошти на розширення.
Інструменти розробника та локальний ШІ
WebGPU-ядра для локального ШІ. На Hugging Face відкрили набір WebGPU-ядер, що покривають понад 200 поширених ML-операцій і дають змогу запускати локальний ШІ повністю в браузері. Ядра вже долучають до Transformers.js, ONNX Runtime Web і LiteRT.js.
GLM-5.3-Flash у llama.cpp. У llama.cpp додали підтримку GLM-5.3-Flash (GLM5-Next), тож модель тепер можна запускати в цьому популярному рушії виводу з відкритим кодом.
Qwen на NPU від AMD. FastFlowLM тепер підтримує запуск Qwen 3.8 27B на NPU від AMD, щоправда швидкість декодування — лише близько 1 токена за секунду. Це демонструє ранні можливості NPU для великих локальних моделей.
Гібридний інференс на Strix Halo. Оновлений llama-halo-hybrid для зв'язки Strix Halo + R9700 розподіляє моделі між APU та GPU, видаючи 60+ ток/с на декодуванні й 2000+ ток/с на префілі з контекстом 256k, та випереджає DGX Spark на Qwen 3.8 Flash Next.
Залізо для локального ШІ. Framework відкрила передзамовлення на свій Desktop з AMD Ryzen AI Max 400 series і 192 ГБ пам'яті. Тим часом покупці повідомляють, що запаси DGX Spark закінчуються, а ціни за тиждень зросли на $2 000.
Індустрія та бізнес
GPT-Synopsys для чипів. OpenAI і Synopsys об'єдналися, щоб створити GPT-Synopsys — спеціалізовану AI-модель, яка вміє міркувати про проєктування й верифікацію чипів і напряму керувати EDA-інструментами Synopsys. Уже тривають ранні тести із замовниками з напівпровідникової галузі.
ElevenLabs: оцінка $22 млрд. Стартап ElevenLabs, що займається AI-голосом, схвалив тендерну пропозицію для співробітників на $300 млн за оцінки компанії $22 млрд — удвічі більше, ніж у лютому. Ця вторинна угода вписується в тренд, де ліквідність для співробітників використовують як інструмент утримання.
IPO OpenAI відклали. Сем Альтман заявив, що OpenAI не виходитиме на біржу, доки не зможе «впевнено ухвалювати рішення щодо безпеки», хоча й визнав, що затягувати з цим погано. Ці слова прозвучали на тлі перевірок безпеки та позову через злам Hugging Face, який скоїли її агенти.
Reddit закриває RSS та API. Reddit припинить підтримку RSS-стрічок 13 листопада, а в березні 2027 року закриє публічний API. Причина — масштабний скрейпінг AI-ботами. Це ще більше обмежує відкритий доступ до контенту, який створюють користувачі Reddit.
Невигідна економіка споживчого ШІ. Попри такі хіти, як Muse від Meta і Dots від OpenAI, фронтирні лабораторії ставляться до споживчого ШІ з обережністю: навіть популярні продукти впираються в стелю того, скільки споживачі готові платити, а кращі моделі не збільшують витрати очевидним чином.
Політика, безпека та суспільство
Техногіганти: пакт про саморегуляцію. Президент Трамп оголосив про «морально зобов'язувальну» Спільну заяву про відповідальність на фронтирі (Joint Commitment on Frontier Responsibilities), яку підписали Google, Anthropic, Meta, OpenAI, xAI і Nvidia. Вона спирається на добровільні аудити й самоконтроль, а не на юридичні вимоги, хоча згодом її можуть закріпити в законі.
Позов через злам Hugging Face. Неприбуткова організація LASST подала до суду на OpenAI через липневу атаку її агентів на Hugging Face, стверджуючи, що «це зробив ШІ» не є виправданням за каліфорнійськими законами про доступ до комп'ютерних систем. Позов вимагає заборонити OpenAI доступ до сторонніх систем і зупинити шкідливі практики розробки.
FTC перевіряє захист споживачів. FTC розслідує OpenAI, Anthropic та інші провідні AI-лабораторії щодо можливих порушень у сфері захисту прав споживачів; цивільні розслідувальні вимоги (Civil Investigative Demands) очікують протягом кількох тижнів. FTC заявляла, що розробники AI відповідають за поведінку своїх агентів.
Вотермарки SynthID Bio. Google DeepMind представила SynthID Bio — proof-of-concept для вбудовування непомітних вотермарок у білки, згенеровані ШІ, зі збереженням їхньої біологічної функції. Мета — посилити біобезпеку та наукову доброчесність.
Суперечка про приватність Muse. Meta заперечила твердження журналіста, що Muse читала приватні повідомлення без дозволу: за словами компанії, інтеграція з Messages повністю опціональна й потребує Full Disk Access і конектора Messages. Утім, питання довіри залишається після того, як ютубер розповів, що Muse під час продажу на Marketplace передала його домашню адресу незнайомцю.
Це все на сьогодні - приблизно 5 хвилин читання.