Нові моделі ШІ та творчі інструменти
Anthropic випустила Claude Sonnet 5, який пропонує продуктивність, близьку до Opus 4.8, за нижчими цінами, і зняла експортні обмеження на Claude Fable 5 та Mythos 5.
Google запустила Nano Banana 2 Lite, свою найшвидшу та найбільш економічну модель зображень, і зробила Gemini Omni Flash доступним для розробників для генерації та редагування відео.
OpenAI випустила GPT-Realtime-2.1 та mini, що пропонують можливості голосового агента з низькою затримкою, покращеним міркуванням та викликом функцій, включаючи зниження затримки p95 на 25%.
Meituan випустила LongCat-2.0, відкриту модель MoE з 1,6 трлн параметрів, спеціально розроблену для агентного кодування, з контекстним вікном 1M та навчену на понад 35 трлн токенів.
Meta запустила Pocket, ігровий застосунок з віб-кодуванням, який дозволяє користувачам генерувати інтерактивні ігри з ШІ-підказок, побудований на основі придбання Gizmo.
Агентні робочі середовища та розробка
Anthropic запустила бета-версію Claude Science, багатоагентне робоче середовище для геноміки, протеоміки та хемоінформатики з підібраними навичками та аудиторськими слідами.
З'явилися відкриті дослідницькі робочі середовища: OpenScience від Synthetic Sciences виконує повні науково-дослідні цикли на вашій власній інфраструктурі, тоді як ResearchStudio пропонує інструменти для ідеації та поширення.
- → Synthetic Sciences Releases OpenScience: An Open-Source, Model-Agnostic AI Workbench for Machine Learning, Biology, Physics, and Chemistry Research
- → ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes
- → ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog
Агенти кодування все частіше створюють реальне програмне забезпечення: sqlite-utils 4.0rc2 було переважно написано Claude, що виявило критичні помилки; shot-scraper додав запис відео для демонстрацій агентів; а новий llm-coding-agent підтримує редагування файлів та виконання команд.
Нові бенчмарки вимірюють продуктивність агентів: EvoPolicyGym показує, що GPT-5.5 лідирує у 16 інтерактивних завданнях з політики, тоді як AgenticDataBench охоплює 15 доменів науки про дані. Тим часом дослідження показує, що кращі моделі можуть бути гіршими у використанні конкретних схем інструментів.
Зміни в робочій силі та галузі
Microsoft запустила Frontier Company, підрозділ впровадження корпоративного ШІ з $2,5 млрд та 6000 експертів, одночасно скоротивши 4800 робочих місць у рамках ширших звільнень.
Генеральний директор Meta Марк Цукерберг повідомив співробітникам, що розробка ШІ-агентів не прискорилася, як очікувалося, і що нещодавні скорочення робочих місць не були такими чистими, як сподівалися.
Amazon припинить приймати нових клієнтів для Mechanical Turk 30 липня 2026 року, згортаючи платформу, яка колись була життєво важливою для маркування даних ШІ.
Політика, безпека та управління
Cloudflare блокуватиме краулери змішаного використання, які поєднують пошук, навчання та використання агентів з сайтів, що підтримуються рекламою, за замовчуванням з 15 вересня.
Alibaba забороняє співробітникам використовувати Claude Code з 10 липня, замість цього просуваючи свій внутрішній інструмент Qoder.
Задокументована атака програм-вимагачів на базі ШІ показує, що агенти можуть виконувати технічне виконання, тоді як уряд Альберти використовував Claude Code для сканування та виправлення вразливостей у 466 мільйонах рядків коду за 20 годин.
Це тиждень у огляді - побачимось наступної неділі.