Відкриті та локальні релізи моделей
Відкрита родина Ornith-1.5. Ornith-1.5 випущено у версіях 9B dense, 35B MoE та 397B MoE під ліцензією MIT із сильними результатами в агентних і кодінг-бенчмарках; квантування спільноти показують, що 35B працює зі швидкістю 60 ток/с на 12GB 4070 Ti, а 9B перевершує попередні малі моделі.
Польові звіти Qwen3.8-27B. Локальні користувачі повідомляють, що Qwen3.8-27B може автономно виконувати понад 80 викликів інструментів і обробляти довгі агентні ланцюжки, але його офлайн-знання та строгі показники кодування слабші, ніж у попередників, тому він найкраще працює з чітким напрямком або копілотом.
Прискорення та кванти Qwen3.8. Зусилля спільноти розігнали Qwen3.8-27B до 138 т/с на RTX 3090 з DFlash2, випустили кванти Dynamic V3, що заявляють про 10% вищу точність, обрізану за глибиною 22.7B Mini-Me та нативний FP4 на V100 2017 року, що відповідає 5090.
- → I pushed Qwen3.8-27B limits again... Dflash2 - 134 tps on a RTX 3090
- → DFlash2 speeds Qwen 3.8 27B up to 4 times
- → Introducing Qwen3.8-27B Dynamic v3 Unsloth GGUFs
- → updated unsloth/Qwen3.8-27B-GGUF · Hugging Face
- → Qwen3.8-23B-Mini-Me: A Depth-Pruned Qwen3.8-27B (to ~22.7BB)
- → NVFP4 on VOLTA! Despite being built for Blackwell, I made four 2017 V100s run Qwen 3.8 NVFP4 natively and match my $6000 RTX 5090.
Базові чекпоінти Ling. AntLing опублікував базові та проміжні чекпоінти для Ling-3.0-tiny і flash без пост-тренування, а користувач поєднує Ling tiny як допоміжний засіб для стиснення контексту разом із Qwen3.8.
Кванти LFM2.5 QAD. Liquid AI випустив чекпоінти Q4_0, навчені за допомогою дистиляції з урахуванням квантування, що відновлюють 97% точності BF16 із тією ж швидкістю та пам'яттю.
GLM-5.3 і фронтирні релізи. GLM-5.3 ділить перше місце з Kimi K3 у рейтингах відкритих моделей завдяки значним агентним досягненням і нижчій вартості, хоча відкриті ваги затримуються на два тижні; також вийшли DeepSeek V4-Pro GA та NVIDIA Nemotron 3.5 Lightning/NeMo Switchyard.
Інструменти агентів та оновлення продуктів
Безпечні пісочниці. Саймон Віллісон протестував smolmachines/smolvm як пісочницю для недовірених Python і JavaScript з обмеженнями на CPU/RAM і без мережі; Джеремі Моррелл стверджує, що розширення, написані LLM, разом із примітивами пісочниці дозволяють створювати безпечне розширюване програмне забезпечення.
Безкоштовний режим Replit. Replit представив безкоштовний режим на основі GPT-5.6 Luna, який дозволяє будь-кому створювати застосунки та агентів без обмежень на вартість токенів.
AI-нотатки Calendly. Calendly вийшов на ринок ведення нотаток на зустрічах із підсумками, пунктами дій і майбутнім асистентом Callie, який використовує контекст зустрічі для планування подальших кроків.
Mac-застосунок Meta AI. Meta запустила Mac-застосунок для свого AI-чатбота з демонстрацією екрана, диктуванням та інтеграцією Google Workspace, щоб конкурувати з настільними асистентами Gemini, ChatGPT і Claude.
Виявлення шахрайства на пристрої WhatsApp. WhatsApp тестує Scam Alert — опційну модель на пристрої, яка класифікує повідомлення від неконтактів, використовуючи конфіденційну федеративну аналітику для збереження приватності.
Навчальні інструменти Google. Google запустив студентський хаб Gemini, інтерактивні візуалізації та вікторини, згенеровані ШІ, у Пошуку, а також Deep Research у Gemini Live до початку навчального року.
Alexa+ безкоштовно на Fire TV. Amazon зробив Alexa+ безкоштовним на Fire TV без Prime, автоматично впроваджуючи розмовний пошук, керування розумним домом та AI-рекомендації.
Індустрія та бізнес
Stripe купує OpenRouter. Stripe підтвердив придбання OpenRouter за 7,5 мільярда доларів, а засновники назвали 'сингулярність' причиною залишатися приватними та інвестувати в агентну інфраструктуру.
Звіт про SpaceX-Cognition спростовано. Bloomberg повідомив, що SpaceX намагався придбати Cognition, але генеральний директор Скотт Ву спростував цю історію, заявивши, що Cognition не продається і жодних переговорів не було.
Лідерство Anthropic за доходами. Anthropic уперше обійшов OpenAI за квартальним доходом, досягнувши 11,6 мільярда доларів із невеликим операційним прибутком, тоді як 6,7 мільярда OpenAI супроводжувалися глибшими збитками.
Обчислювальні потужності як клас активів. Nvidia працює з Apollo, BlackRock та іншими над фінансуванням у 500 мільярдів доларів, щоб розглядати обчислювальні потужності як інвестиційний актив; Silicon Data залучив 30 мільйонів доларів для запуску CME GPU-ф'ючерсів.
Пам'ять і постачання чипів. Ціни на DRAM зросли на 500% за 12 місяців, а гіперскейлери зарезервували постачання на 2027 рік; Китай дозволяє невеликі партії H200 для ByteDance і Tencent, щоб послабити дефіцит інференс-потужностей.
Інфраструктура дата-центрів. TerraPower планує проєкт дата-центру з використанням накопичувача енергії свого реактора Natrium, а Relativity Networks залучила 22 мільйони доларів на порожнисто-серцевинне волокно, яке передає дані на 50% швидше.
Репутація ШІ погіршується. Pew виявив, що 52% американців більше стурбовані, ніж захоплені ШІ, а місцеві угоди щодо дата-центрів стикаються з громадським опором.
Безпека, приватність та захист
Приватна обробка безпеки OpenAI. OpenAI представив попередню версію Private Safety Processing для клієнтів із нульовим зберіганням даних, що дозволяє виявляти зловживання у взаємодіях без розкриття вмісту персоналу; це контрастує з політикою 30-денного зберігання Anthropic.
OpenAI виправляє Codex і TAC. OpenAI випустив захисні заходи після того, як Codex видалив реальні файли користувачів через хибні команди очищення, і підтвердив, що окрема помилка тимчасово скасувала доступ до його програми Trusted Access for Cyber.
ICS-експлойти, згенеровані ШІ. Агентства США попередили, що зловмисники використовують ШІ для створення скриптів експлойтів для Siemens S7, знижуючи необхідну кваліфікацію та час для атак на промислові системи управління.
Внутрішній контроль лабораторій ШІ. Перша оцінка Guidelight показала, що жодна AI-компанія повністю не застосовує базовий внутрішній контроль; Anthropic і OpenAI лідирують із C+, тоді як xAI і Meta отримують D- та F.
Діпфейк-реклама Meta. Meta розміщувала рекламу AI-застосунку для оголення зображень, орієнтовану на жінок-політикинь, попри політики, що забороняють сексуальний матеріал.
Продаж даних співробітників Spirit. Google виграв аукціон на дані про працівників Spirit Airlines; колишні бортпровідники заперечують, що конфіденційність працівників може бути не захищена від реідентифікації.
OpenAI сповільнює розробку. OpenAI призупинив деякі RL-тренування і відклав фронтирні запуски, посилюючи захисні заходи, перевіряючи, чи може добровільне сповільнення працювати без загальногалузевого впровадження.
Дослідження та аналіз
Дизайн білків Claude. Моделі Claude від Anthropic спроєктували мінібіндери для 15 мішеней із показником успіху 26.8%, що перевищує типові ранні результати відкриття ліків, хоча незалежний огляд ще не завершено.
Дані про тканини Vivodyne. Роботизовані лабораторії HIVE від Vivodyne вирощують 20 типів людських тканин і генерують каузальні біологічні дані, щоб вирішити проблему браку даних у відкритті ліків за допомогою ШІ, яку вони вважають ключовою.
Міф про токени міркування. Дослідження ставить під сумнів ідею, що проміжні токени LLM є семантично значущими міркуваннями; моделі часто створюють недійсні траси навіть із правильними відповідями, а навчання на пошкоджених трасах все одно може працювати.
Метрика продуктивності кодування. Саймон Віллісон стверджує, що рядки налагодженого продакшн-коду залишаються значущою метрикою продуктивності з кодінг-агентами, але досягнення такого результату все одно потребує навичок старшого інженера.
Це все на сьогодні - приблизно 5 хвилин читання.