Релізи моделей та агентів
Grok 4.6 та Grok Bot. SpaceXAI випустила Grok 4.6, який зрівнюється з GPT-5.6 Sol від OpenAI і поступається лише Claude Opus 5 за індексом Artificial Analysis, одночасно знижуючи ціни на фронтирні моделі, а також представила Grok Bot — постійно активного AI-напарника, який працює з власного хмарного комп'ютера для виконання поставлених завдань.
Qwen 3.8 велика та мала. Qwen3.8-2.4T-A95B тепер доступна, а сторінка Qwen3.8 27B ненадовго з'явилася на ModelScope перед видаленням, що вказує на найближчий реліз. Ентузіасти локального запуску вже планують розподіл обладнання для моделі 2.4T.
Оновлення DeepSeek V4 Pro. V4 Pro 0813 від DeepSeek доступний через API на OpenRouter, офіційної сторінки анонсу ще немає; відкриті ваги ймовірні з огляду на попередні релізи. Його поведінка міркувань помітно різниться на низькому, середньому та високому рівнях міркувань.
Edge-моделі зору. LFM2.5-VL-3B від Liquid AI забезпечує значно краще розуміння UI і може працювати на телефонах, тоді як Apache-2.0 North Micro Vision від Cohere пропонує підтримку зображень у рідній роздільній здатності в компактному пакеті з 2,4 млрд параметрів.
Трильйонна модель Nvidia. За повідомленнями, Nvidia будує Nemotron 4 щонайменше з одним трильйоном параметрів і потроює витрати на хмарне навчання до $28 мільярдів до 2031 року, прагнучи конкурувати з китайськими моделями з відкритими вагами.
Розробка агентів та інструменти
Керовані агенти та BYOC. LangChain запустила Managed Deep Agents як наступний крок після фреймворків і зробила LangSmith BYOC загальнодоступним на AWS, дозволяючи підприємствам зберігати трейси агентів і дані у власному VPC.
Застосунок ChatGPT на Linux. OpenAI випустила десктопний застосунок для Linux, який включає ChatGPT, ChatGPT Work і Codex, але нативне керування комп'ютером недоступне на момент запуску.
Локальний інференс та обладнання
Ціна RTX PRO 6000 подвоїлася. Nvidia майже подвоїла рекомендовану роздрібну ціну 96GB RTX PRO 6000 Blackwell до $16,000, після того як попередні замовлення минулого року були нижче $8,000.
DSpark стримінг на одному GPU. Один RTX PRO 6000 96GB може запускати DeepSeek V4 Flash 284B зі швидкістю близько 31 токена на секунду з чернеткою DSpark у системній пам'яті, що приблизно на 15-17% швидше за базовий рівень без чернетки при однаковому використанні VRAM.
Muse Glimmer на Mac. Muse Glimmer 30B від Meta тепер працює до приблизно 3,3 рази швидше на Apple Silicon за допомогою mlx-dspark, забезпечуючи якість 8-біт на швидкостях, близьких до 4-біт, на Mac з 48GB пам'яті.
Квантування KV-кешу Gemma 4. Навчання з урахуванням квантування допомагає Gemma 4 31B зберігати якість при агресивному квантуванні KV-кешу, роблячи інференс з великим контекстом практичнішим.
Індустрія та бізнес
Cognition залучає інвестиції за оцінки $40 млрд. Виробник AI-кодинг агентів Cognition, за повідомленнями, веде переговори про залучення інвестицій за оцінки $40 мільярдів після досягнення $1 мільярда річного ануалізованого доходу, порівняно з $492 мільйонами три місяці тому.
Lovable досягає $13.3B. Стартап vibe-coding Lovable залучив $400 мільйонів за оцінки $13.3 мільярда після перевищення $500 мільйонів ануалізованого доходу, з 60 мільйонами розміщених проєктів.
Корпоративний ШІ від Thrive Holdings. Thrive Holdings, яку підтримує OpenAI, залучив $2 мільярди за оцінки $12 мільярдів для придбання традиційних бізнесів і впровадження ШІ, розширюючись за межі бухгалтерського обліку та ІТ.
Частка Gemini падає. Дані ринку від Pangram, OpenRouter і Similarweb показують зниження використання Gemini, при цьому Pangram фіксує падіння до 1,9% написання текстів зі ШІ, тоді як OpenAI утримує понад 50%.
Claude виходить у юридичну сферу. Anthropic найняв засновника legal AI Роберта Махарі на посаду першого керівника Claude for Legal, розвиваючи попередні юридичні плагіни та партнерства.
Політика, безпека та суспільство
Витік у ланцюзі постачання LiteLLM. Атака на ланцюг постачання LiteLLM викрила терабайти облікових даних із понад 2,500 організацій, зокрема Microsoft, Amazon і Samsung, через шкідливі пакети PyPI.
Водяні знаки на виході Claude. Anthropic тепер додає водяні знаки до виходу Claude для відповідності Європейському закону про ШІ, що засмучує користувачів, які хвилюються, що це викриє використання ШІ на роботі чи в навчанні.
Twitch за замовчуванням використовує для навчання. Twitch за замовчуванням навчатиме моделі Amazon AI на контенті стримерів, і тепер доступний перемикач для відмови; ця політика викликала обурення.
ShieldFont замінює текст. Дизайнери випустили ShieldFont — шрифт, який показує користувачам звичайний текст, але замінює слова в базовому HTML, щоб отруювати скрапери.
Hinton, Li, Ng про відкритий ШІ. На Ai4 Geoffrey Hinton, Fei-Fei Li та Andrew Ng виступили за збереження відкритості ШІ, щоб уникнути контролю доступу з боку кількох компаній, попри занепокоєння щодо безпеки відкритих ваг.
Знищення рідкісних книжок. Продавці книжок побоюються, що компанії зі ШІ купують рідкісні книжки та знищують їх для навчання, попри наявність незнищувальних альтернатив сканування.
Дослідження та бенчмарки
MindTopo топологічне міркування. Бенчмарк MindTopo від Microsoft Research показує, що мультимодальні моделі добре справляються зі статичним топологічним розпізнаванням, але мають труднощі з інтерактивним плануванням, яке вимагає підтримки зв'язків у часі.
Відновлення промптів з виходу. IIT Bombay та Adobe Research розробили Previous-Token Prediction, який може відновлювати промпти LLM з вихідного тексту з майже ідеальною точністю без ваг моделі.
Це все на сьогодні - приблизно 5 хвилин читання.