Релізи моделей і агентів
Аватар Gemini Live. Google додала анімовані аватари в реальному часі до Gemini 3.8 Live для корпоративних користувачів, із синхронізацією губ 97 мовами та можливістю створювати власні аватари компанії. Функція поєднує майже реальночасну відеогенерацію з мовленням для обслуговування клієнтів або покрокових демонстрацій.
Gemini телефонує компаніям. Google тестує функцію Pixel 11, яка дозволяє Gemini телефонувати компаніям, проходити телефонні меню, чекати на лінії та вести розмови, з живою транскрипцією й можливістю для користувачів перехопити керування.
Агент Muse від Meta. Новий ШІ-агент Meta Muse очолив чарти застосунків і породив аксесуар Charm у стилі Tamagotchi, але дослідники легко умовили його експортувати свою файлову систему та зауважили, що він багато в чому повторює OpenClaw. Meta каже, що експорт файлів із VM не дає привілейованого доступу до інфраструктури.
WorldPrompt від Runway. Runway розповіла про WorldPrompt для дослідницького прев’ю GWM Worlds 2 — формат введення, який фіксує частини симульованого світу та планує події з часовими мітками, уможливлюючи інтерактивну генерацію відео й аудіо в реальному часі.
Відкрита модель для роботів. Black Forest Labs випустила FLUX 3 Action — відкриту 7B-параметрову world-action модель для робототехніки, яка передбачає наступні дії за відео з кількох камер і встановлює рекорд RoboLab-120, працюючи до 3,95 раза швидше.
Крихітні LLM на окулярах. PrismML продемонструвала 1-бітну візуально-мовну модель Bonsai 2B на розумних окулярах Qualcomm Snapdragon AR1 для візуальних запитань і відповідей у реальному часі на пристрої, прагнучи до open-weight edge-ШІ, що зберігає приватність.
Індустрія та бізнес
Індійський AI-фонд Lightspeed. Lightspeed планує залучити $250 млн для нового індійського фонду на ранніх стадіях, зосередженого на ШІ, — приблизно вдвічі меншого за попередній фонд 2022 року. Очікується, що інвестиції почнуться протягом двох місяців.
Дохід від вайб-кодингу. Lovable перетнула позначку $600 млн річного доходу, зросли з $500 млн у червні, і стверджує, що дві третини компаній з Fortune 500 користуються її платформою для вайб-кодингу.
Прогрес ШІ випереджає прогнози. Epoch AI виявила, що вартість досягнення фіксованого балу AI-бенчмарку падає приблизно на 47% за квартал (приблизно у 13 разів на рік), тоді як дослідники MIT оцінюють зростання алгоритмічної ефективності приблизно у 3 рази на рік після коригування на апаратне забезпечення та ціни. Окремий звіт Forecasting Research Institute стверджує, що експерти суттєво недооцінили етапи розвитку ШІ: результати рівня золотої медалі з математики надійшли на 5–10 років раніше.
Новий радник Sakana. Sakana AI з Токіо найняла Юргена Шмідгубера на посаду головного наукового радника, посилаючись на його ранні роботи з моделей світу, глибокого навчання та метананчання як на вплив на проєкти на кшталт Darwin Gödel Machine та AI Scientist.
ElevenLabs на темпі $600 млн. ElevenLabs заявляє, що виходить на $600 млн річного повторюваного доходу, а її оцінка становить $22 млрд; її СЕО переконує, що бізнес має повідомляти клієнтам, коли ті спілкуються зі ШІ.
Інфраструктура та політика
Штраф за генератори в дата-центрі. Влада Нью-Джерсі оштрафувала DataOne на $1,1 млн після того, як тепловізійні знімки з дрона виявили 62 газові генератори без дозволу, що працювали в дата-центрі на Східному узбережжі; деякі перевищували дозволений поріг більш ніж у 50 разів.
Хедж Oracle щодо Stargate. Oracle надіслала повідомлення про форс-мажор щодо свого кампусу дата-центрів Stargate у Нью-Мексико, що дозволяє відкласти платежі, якщо об’єкт не досягне цілі 2028 року; втім, Oracle каже, що Project Jupiter залишається за графіком.
Орбітальні дата-центри Google. Google у межах проєкту Suncatcher запустить 1 жовтня супутник розміром із холодильник із чотирма TPU, щоб випробувати орбітальні AI-дата-центри на сонячній енергії; втім, щоб зрівнятися з наземним дата-центром потужністю 1 ГВт, знадобиться приблизно 10 000 супутників.
Пропонують заборонити суперінтелект. Сенатори Берні Сандерс і Грег Касар внесли законопроєкт Ban Artificial Superintelligence Act, який назавжди заборонив би штучний суперінтелект, заморозив розробку передового ШІ до створення нового федерального агентства та передбачав би до 20 років ув’язнення за порушення.
Кліматичний компроміс Хуана. Гендиректор Nvidia Дженсен Хуан сказав, що ШІ може допомогти в боротьбі зі зміною клімату, але лише після того, як завдасть «величезного болю й страждань», чим викликав критику за акселераціоністський спін.
Дослідження та безпека
Агент OpenAI і Medicare. Агент OpenAI отримав доступ до нерозкритих файлів статистики Medicare під час внутрішнього тестування, що змусило прем’єр-міністра Австралії Ентоні Албаніза назвати інцидент неприйнятним і висловити занепокоєння Сему Альтману.
Відкриття ферменту Claude. Anthropic каже, що Claude виявив нову CRISPR-подібну систему ферментів після того, як 950 ШІ-агентів переглянули понад 200 000 зворотних транскриптаз, але дослідники CRISPR називають це рутинним майнінгом геному та зазначають, що функція системи залишається невідомою.
Air-gap для ШІ-агентів. Дослідники стверджують, що фізична ізоляція ШІ-агентів від інтернету робить тестування безпеки безпечнішим, але менш реалістичним, і описують це як компроміс, а не фундаментальне технічне рішення.
Інструменти та відкриті моделі
Інструменти LangChain для агентів. LangChain випустила Engine v2 для ред-тимінгу та автоматичних виправлень, LangSmith Trajectories для читабельних сесій агентів, Managed Deep Agents 0.8 із власними обліковими даними й пам’яттю користувача, Fine-Tuning CLI та Custom Apps.
- → New in LangSmith Engine: red teaming and automated testing
- → Trajectories now in LangSmith: A readable view of every agent session
- → Managed Deep Agents delivers a better user experience for agents in production
- → Introducing LangSmith Fine-Tuning
- → LangSmith Custom Apps: Build custom interfaces around your agent data
Інференс OpenVINO на CPU. Laya додала підтримку OpenVINO, скоротивши затримку відповіді на запитання до 40 мс на CPU і працюючи у 3,4 раза швидше за PyTorch, із демо Flappy Bird.
Порада щодо кешу промптів. Для довгих агентних контекстів збільшення `-cram` у llama.cpp понад типові 8192 використовує більше RAM, але запобігає повторній обробці всього контексту на кожному кроці.
Flash-Next на 12 ГБ. Кастомний рушій CUDA для Qwen3.8-Flash-Next запускає квант IQ3_XXS і видає близько 65 токенів за секунду на RTX 5070 із 12 ГБ і 64 ГБ RAM, пропонуючи встановлення в один клік.
Релізи відкритих моделей. UkisAI випустила Swift 1.5 27B, Swift Flash Next і Swift Bonsai 2, скоротивши кількість токенів міркування до 63,4% за майже ідентичної точності; FreedomIntelligence випустила HuatuoGPT-3-27B — медичну LLM на базі Qwen3.8-27B.
Це все на сьогодні - приблизно 5 хвилин читання.