Nowe modele AI i narzędzia kreatywne
Anthropic wydał Claude Sonnet 5, oferując wydajność zbliżoną do Opus 4.8 w niższych cenach, oraz zniósł kontrole eksportowe na Claude Fable 5 i Mythos 5.
Google uruchomił Nano Banana 2 Lite, swój najszybszy i najbardziej opłacalny model obrazowy, oraz udostępnił Gemini Omni Flash programistom do generowania i edycji wideo.
OpenAI wydał GPT-Realtime-2.1 i mini, oferując możliwości agenta głosowego o niskim opóźnieniu z ulepszonym rozumowaniem i wywoływaniem funkcji, w tym 25% redukcją opóźnienia p95.
Meituan wydał LongCat-2.0, otwarty model MoE z 1,6T parametrami, zaprojektowany specjalnie do kodowania agentskiego, z oknem kontekstowym 1M i wytrenowany na 35T+ tokenach.
Meta uruchomił Pocket, aplikację do gier kodowaną w stylu vibe, która pozwala użytkownikom generować interaktywne gry z promptów AI, zbudowaną na bazie przejęcia Gizmo.
Agentyczne stanowiska pracy i rozwój
Anthropic uruchomił betę Claude Science, wieloagentowe stanowisko pracy do genomiki, proteomiki i chemoinformatyki z wyselekcjonowanymi umiejętnościami i śladami audytu.
Pojawiły się otwartoźródłowe stanowiska badawcze: OpenScience od Synthetic Sciences przeprowadza pełne pętle badań naukowych na własnej infrastrukturze, podczas gdy ResearchStudio oferuje narzędzia do generowania pomysłów i rozpowszechniania.
- → Synthetic Sciences Releases OpenScience: An Open-Source, Model-Agnostic AI Workbench for Machine Learning, Biology, Physics, and Chemistry Research
- → ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes
- → ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog
Agenci kodujący coraz częściej tworzą prawdziwe oprogramowanie: sqlite-utils 4.0rc2 został w większości napisany przez Claude, łapiąc krytyczne błędy; shot-scraper dodał nagrywanie wideo do demonstracji agentów; a nowy llm-coding-agent obsługuje edycję plików i wykonywanie poleceń.
Nowe benchmarki mierzą wydajność agentów: EvoPolicyGym pokazuje, że GPT-5.5 osiąga najlepsze wyniki w 16 interaktywnych zadaniach politycznych, podczas gdy AgenticDataBench obejmuje 15 dziedzin nauki o danych. Tymczasem badanie wykazuje, że lepsze modele mogą być gorsze w korzystaniu z określonych schematów narzędzi.
Zmiany w sile roboczej i przemyśle
Microsoft uruchomił Frontier Company, jednostkę wdrożeniową AI dla przedsiębiorstw o wartości 2,5 mld dolarów z 6 000 ekspertów, jednocześnie redukując 4 800 miejsc pracy w ramach szerszych zwolnień.
CEO Meta Mark Zuckerberg powiedział pracownikom, że rozwój agentów AI nie przyspieszył zgodnie z oczekiwaniami, a ostatnie cięcia etatów nie były tak czyste, jak oczekiwano.
Amazon przestanie przyjmować nowych klientów dla Mechanical Turk 30 lipca 2026 roku, wygaszając platformę niegdyś kluczową dla etykietowania danych w AI.
Polityka, bezpieczeństwo i zarządzanie
Cloudflare domyślnie zablokuje crawlerów o mieszanym zastosowaniu, którzy łączą wyszukiwanie, uczenie i korzystanie z agentów z witryn wspieranych reklamami, począwszy od 15 września.
Alibaba zabrania pracownikom używania Claude Code od 10 lipca, promując zamiast tego swoje wewnętrzne narzędzie Qoder.
Udokumentowany atak ransomware przeprowadzony przez AI pokazuje, że agenci mogą obsługiwać techniczną realizację, podczas gdy rząd Alberty użył Claude Code do skanowania i naprawiania luk w 466 milionach linii kodu w 20 godzin.
To tyle na ten tydzień - do zobaczenia w przyszłą niedzielę.