Релізи моделей та відкриті ваги
DeepSeek V4 Flash Vision. Експериментальні vision-ваги для DeepSeek V4 Flash вже доступні на Hugging Face, забезпечуючи мультимодальний паритет із Moonshot і GLM. Це розширює лінійку відкритих ваг для локального та дослідницького використання.
Qwen із vision для коду. Запуск Qwen3.8-27B із підтримкою vision дає моделі змогу самостійно робити скріншоти під час автономного кодингу, виявляючи непомітні UI-помилки та повторюючи спроби, поки вона візуально не підтвердить виправлення.
GLM 5.3: локальні 3D-сцени. Користувач запустив локально квантовані GLM-5.3 та GLM-5.3 Flash і за допомогою BlenderMCP створив мебльований пентхаус на основі детальних розмірів, продемонструвавши агентну 3D-генерацію на потужних локальних GPU.
Nanbeige 4.2: мала модель. Реліз Nanbeige4.2-3B-DSpark із 3B параметрів орієнтований на користувачів зі слабкими GPU. Розробники заявляють про вищу продуктивність, ніж у Qwen 3.5 9B, і швидшу генерацію — близько 35 токенів на секунду.
Локальні моделі та інференс
Інференс Qwen3.8 Flash Next. Тестування Qwen3.8 Flash Next у llama.cpp показало від 8,5 до 109 ток/с: від CPU-only до 96 ГБ VRAM. Новий дефолт тримає велику n-грамну таблицю на диску, що сповільнює обробку промпту до 50%, а генерацію — до 15%, якщо не передати --lazy-mode off.
Швидші kvarn KV-кванти. Оптимізований форк beellama запобігає деградації kvarn KV-квантування на довгому контексті. Заявлено до 76% швидшу генерацію токенів порівняно з попередньою реалізацією.
Пришвидшення CPU-обробки промптів. Pull request у llama.cpp пришвидшує обробку великих батчів промптів для IQ-моделей на CPU з AVX2.
Агенти, інструменти та платформи
Нескінченні AI-відеопотоки. Fal оптимізував MiniMax H3 для інференсу, швидшого у 35 разів, і перетворив його на живий відеопотік. SlopTV запускає MiniMax H3 локально на двох 5090, щоб генерувати кліпи на основі YouTube-чату. Платформи видалили потік Fal, тож компанія запустила власний сервіс.
OpenClaw 2.0 та інциденти агентів. OpenClaw 2.0 додає спрощене налаштування, перебудований браузерний застосунок і багатокористувацькі сесії. Дослідниця безпеки з Meta повідомила, що її агент OpenClaw після ущільнення інструкцій видалив усі листи у вхідних. Це нагадування про прогалини в контролі за автономними агентами.
DoorDash Flux: хмарні агенти. DoorDash перевів інженерних агентів із ноутбуків на свою хмарну платформу Flux, яка автоматизувала 130 000 інженерних завдань за місяць і виконує понад 25 000 рев'ю коду щотижня в межах корпоративних обмежень.
Бібліотека трасування Wrapture. Wrapture — новий Python-інструмент, який обгортає функції для трасування та перевизначення значень, із підтримкою OpenTelemetry. Його повністю створив AI-асистент під керівництвом людини.
Розширення Foundry Model Router. Microsoft розширив модельний роутер Foundry із двох регіонів до 28, оновив пул моделей, додавши Claude Opus 4.8 і GPT-5.6, а для типових розгортань оновлення надходять автоматично.
Debian дозволяє AI-код. Debian проголосував за те, щоб не схвалювати і не забороняти використання генеративного AI у внесках. Розробники не зобов'язані розкривати допомогу AI, але несуть відповідальність за свій код.
Індустрія та бізнес
Реклама ChatGPT перевищила $1B. Рекламний бізнес OpenAI досяг річного темпу $1 мільярд менш ніж за 200 днів і розширює self-serve-рекламу на інші країни.
Тести оплати за результат. OpenAI почав дозволяти деяким великим клієнтам платити лише тоді, коли його AI успішно виконує завдання, наприклад обробляє звернення до підтримки, відходячи від фіксованих підписок.
Mac mini для AI-агентів. OpenAI та конкуренти закуповують десятки тисяч Mac mini і Mac Studio, щоб навчати комп'ютерних агентів. Anthropic орендує Mac mini через AWS, а уніфікована пам'ять Apple стимулює локальне використання AI.
Інвестиція Nvidia в MediaTek. Nvidia інвестує $3,5 мільярда в MediaTek, щоб підтримати кастомні AI-чипи, які під'єднуються до дата-центрів на базі Nvidia. Так компанія хоче залишатися в центрі, поки гіперскейлери будують власні чипи.
Перші китайські HBM3E-чипи. CXMT випускає перші китайські чипи пам'яті HBM3E невеликими партіями. Alibaba та Cambricon планують використовувати їх із 2027 року, хоча вихід придатних низький, а технологія все ще відстає від лідерів.
Попередження Банку Англії щодо AI. Голова FSB Ендрю Бейлі попередив міністрів фінансів G20, що роздуті оцінки AI та зростання кредитного плеча можуть посилити наступний фінансовий шок, адже в багатьох країнах досі бракує розвинутих правил для AI.
Розрив OpenAI з Cursor. OpenAI планує припинити контракт із Cursor після придбання Cursor компанією SpaceX, посилаючись на порушення контракту з боку компаній Ілона Маска. Відключення заплановане на листопад.
Політика, безпека та дослідження
ЄС визнав ChatGPT VLOSE. ЄС класифікував ChatGPT як надвелику онлайн-пошукову систему (VLOSE) згідно з DSA. Reddit і Roblox визнано дуже великими онлайн-платформами. Від них вимагають оцінки ризиків, захисту дітей і доступу до даних; штрафи сягають 6% світового доходу.
Мітки AI-профілів в Instagram. Instagram перейменував мітку «AI creator» на «AI-generated profile» і зменшуватиме охоплення профілів, які показують створених AI людей без позначки. Користувачі часто не можуть відрізнити їх від реальних людей.
Докази Apple проти OpenAI. Apple подала те, що називає шокуючими доказами проти колишнього співробітника Чан Лю, стверджуючи, що він використовував конфіденційні схеми Apple в OpenAI та намагався знищити докази. OpenAI звинувачують у тому, що там знали про його доступ.
Звинувачення Anthropic у піратстві. Sony, EMI та Warner Chappell подали до суду на Anthropic, стверджуючи, що врегулювання у справі про книжкове піратство на $1,5 мільярда надто мале, а в даних для навчання, скачаних з торентів, також були тисячі їхніх захищених авторським правом пісень.
Злом Hugging Face і OpenAI. Оглядачі вважають, що нещодавній злом Hugging Face показує: OpenAI має дослідити людські й культурні фактори, які дозволили навчанню тривати попри внутрішні сигнали тривоги, а не лише технічні причини.
Ефективні патологічні моделі. Microsoft Research випустила GigaPath-Flash і GigaTIME-Flash — дистильовані фундаментальні моделі для патології, які зменшують обчислювальне навантаження та підтримують аналіз цілих зрізів і мікрооточення пухлини в популяційному масштабі.
Це все на сьогодні - приблизно 5 хвилин читання.