Neue KI-Modelle und kreative Tools
Anthropic hat Claude Sonnet 5 veröffentlicht, das eine Leistung nahe an Opus 4.8 zu niedrigeren Preisen bietet, und Exportkontrollen für Claude Fable 5 und Mythos 5 aufgehoben.
Google hat Nano Banana 2 Lite veröffentlicht, sein schnellstes und kosteneffizientestes Bildmodell, und Gemini Omni Flash für Entwickler zur Videogenerierung und -bearbeitung verfügbar gemacht.
OpenAI hat GPT-Realtime-2.1 und mini veröffentlicht, die Sprachagent-Funktionen mit niedriger Latenz, verbessertem Reasoning und Funktionsaufruf bieten, einschließlich einer 25-prozentigen Reduzierung der p95-Latenz.
Meituan hat LongCat-2.0 veröffentlicht, ein offenes MoE-Modell mit 1,6 Billionen Parametern, das speziell für agentisches Codieren entwickelt wurde, mit einem 1M-Kontextfenster und Training auf über 35 Billionen Tokens.
Meta hat Pocket gestartet, eine vibe-codierte Gaming-App, mit der Benutzer interaktive Spiele aus KI-Prompts generieren können, basierend auf der Übernahme von Gizmo.
Agentische Arbeitsumgebungen und Entwicklung
Anthropic hat Claude Science Beta gestartet, eine Multi-Agenten-Arbeitsumgebung für Genomik, Proteomik und Chemieinformatik mit kuratierten Fähigkeiten und Audit-Trails.
Open-Source-Forschungsarbeitsplätze sind entstanden: Synthetic Sciences' OpenScience führt vollständige wissenschaftliche Forschungsschleifen auf Ihrer eigenen Infrastruktur aus, während ResearchStudio Werkzeuge für Ideenfindung und Verbreitung bietet.
- → Synthetic Sciences Releases OpenScience: An Open-Source, Model-Agnostic AI Workbench for Machine Learning, Biology, Physics, and Chemistry Research
- → ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes
- → ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog
Codierungsagenten bauen zunehmend echte Software: sqlite-utils 4.0rc2 wurde größtenteils von Claude geschrieben und hat kritische Fehler erkannt; shot-scraper hat Videoaufzeichnung für Agentendemos hinzugefügt; und ein neuer llm-coding-agent unterstützt Dateibearbeitung und Befehlsausführung.
Neue Benchmarks messen die Agentenleistung: EvoPolicyGym zeigt, dass GPT-5.5 16 interaktive Policy-Aufgaben meistert, während AgenticDataBench 15 Data-Science-Domänen abdeckt. Eine Studie stellt fest, dass bessere Modelle bei der Verwendung spezifischer Tool-Schemata schlechter abschneiden können.
Arbeitskräfte und Branchenveränderungen
Microsoft hat Frontier Company gestartet, eine 2,5-Milliarden-Dollar-Einheit für den Einsatz von Unternehmens-KI mit 6.000 Experten, während gleichzeitig 4.800 Stellen in breiteren Entlassungen gestrichen wurden.
Meta-CEO Mark Zuckerberg sagte den Mitarbeitern, dass die Entwicklung von KI-Agenten nicht wie erwartet beschleunigt wurde und dass die jüngsten Stellenstreichungen nicht so sauber waren wie erhofft.
Amazon wird ab dem 30. Juli 2026 keine neuen Kunden mehr für Mechanical Turk akzeptieren und eine Plattform schließen, die einst für die KI-Datenkennzeichnung von entscheidender Bedeutung war.
Politik, Sicherheit und Governance
Cloudflare wird ab dem 15. September standardmäßig Crawler mit gemischter Nutzung blockieren, die Suche, Training und Agentennutzung von werbefinanzierten Websites kombinieren.
Alibaba verbietet Mitarbeitern ab dem 10. Juli die Nutzung von Claude Code und drängt stattdessen auf das interne Qoder-Tool.
Ein dokumentierter KI-gesteuerter Ransomware-Angriff zeigt, dass Agenten technische Ausführungen übernehmen können, während die Regierung von Alberta Claude Code verwendete, um Schwachstellen in 466 Millionen Codezeilen in 20 Stunden zu scannen und zu beheben.
Das war die Wochenrückschau - bis nächsten Sonntag.