Agentic AI News Heute

Die Nachrichten über KI-Agenten des Tages in einer 5-minütigen Lektüre: Veröffentlichungen, Tools, Forschung, Finanzierung und Unternehmensentwicklungen.

Täglich aktualisiert zusammengestellt aus 30 Quellen Donnerstag, August 13, 2026

Modell- & Agenten-Releases

Grok 4.6 und Grok Bot. SpaceXAI hat Grok 4.6 veröffentlicht, das auf dem Artificial Analysis Index mit OpenAI's GPT-5.6 Sol gleichzieht und nur hinter Claude Opus 5 zurückbleibt, während es die Preise der Spitzenmodelle unterbietet. Außerdem wurde Grok Bot eingeführt, ein ständig aktiver KI-Teamkollege, der von seinem eigenen Cloud-Computer aus arbeitet, um zugewiesene Aufgaben zu erledigen.

Qwen 3.8 groß und klein. Qwen3.8-2.4T-A95B ist jetzt verfügbar, und eine 27B Qwen3.8-Seite erschien kurzzeitig auf ModelScope, bevor sie entfernt wurde, was auf eine baldige Veröffentlichung hindeutet. Enthusiasten für lokalen Betrieb planen bereits Hardware-Aufteilungen für das 2.4T-Modell.

DeepSeek V4 Pro Update. DeepSeek's V4 Pro 0813 ist über die API auf OpenRouter verfügbar, jedoch noch ohne offizielle Ankündigungsseite; offene Gewichte sind angesichts früherer Veröffentlichungen wahrscheinlich. Das Reasoning-Verhalten unterscheidet sich deutlich zwischen niedrigen, mittleren und hohen Reasoning-Stufen.

Edge-Vision-Modelle. Liquid AI's LFM2.5-VL-3B bietet ein deutlich stärkeres UI-Grounding und kann auf Telefonen laufen, während Cohere's Apache-2.0 North Micro Vision Unterstützung für Bilder in nativer Auflösung in einem kompakten 2,4B-Parameter-Paket bietet.

Nvidias Billionen-Parameter-Modell. Nvidia baut Berichten zufolge Nemotron 4 mit mindestens einer Billion Parametern und verdreifacht die Ausgaben für Cloud-Training auf 28 Milliarden Dollar bis 2031, um mit chinesischen Open-Weight-Modellen zu konkurrieren.

Agentenentwicklung & Tools

Verwaltete Agenten und BYOC. LangChain hat Managed Deep Agents als nächsten Schritt nach Frameworks eingeführt und LangSmith BYOC allgemein auf AWS verfügbar gemacht, sodass Unternehmen Agent-Traces und Daten in ihrer eigenen VPC behalten können.

ChatGPT-App unter Linux. OpenAI hat eine Linux-Desktop-App veröffentlicht, die ChatGPT, ChatGPT Work und Codex bündelt, aber die native Computernutzung ist zum Start nicht verfügbar.

Lokale Inferenz & Hardware

RTX PRO 6000 Preis verdoppelt. Nvidia hat den UVP des 96GB RTX PRO 6000 Blackwell auf 16.000 $ fast verdoppelt, nachdem Vorbestellungen im letzten Jahr unter 8.000 $ lagen.

DSpark Streaming auf einer GPU. Eine einzelne RTX PRO 6000 96GB kann DeepSeek V4 Flash 284B mit etwa 31 Token pro Sekunde mit DSpark's Drafter im Arbeitsspeicher ausführen, etwa 15-17% schneller als die Basislinie ohne Drafter bei gleicher VRAM-Nutzung.

Muse Glimmer auf dem Mac. Metas Muse Glimmer 30B läuft jetzt mit mlx-dspark auf Apple Silicon bis zu etwa 3,3-mal schneller und liefert 8-Bit-Qualität bei nahezu 4-Bit-Geschwindigkeit auf einem 48GB Mac.

Gemma 4 KV-Cache-Quantisierung. Quantisierungsbewusstes Training hilft Gemma 4 31B, die Qualität unter aggressiver KV-Cache-Quantisierung zu erhalten, was Inferenz mit großem Kontext praktikabler macht.

Industrie & Business

Cognition Finanzierung bei 40 Mrd. $. Der KI-Coding-Agent-Hersteller Cognition befindet sich Berichten zufolge in Gesprächen, um bei einer Bewertung von 40 Milliarden Dollar Kapital aufzunehmen, nachdem er eine annualisierte Umsatzrate von 1 Milliarde Dollar erreicht hat, gegenüber 492 Millionen Dollar vor drei Monaten.

Lovable erreicht 13,3 Mrd. $. Das Vibe-Coding-Startup Lovable hat 400 Millionen Dollar bei einer Bewertung von 13,3 Milliarden Dollar eingesammelt, nachdem es 500 Millionen Dollar an annualisiertem Umsatz überschritten hat, mit 60 Millionen gehosteten Projekten.

Thrive Holdings Enterprise-KI. Das von OpenAI unterstützte Thrive Holdings hat 2 Milliarden Dollar bei einer Bewertung von 12 Milliarden Dollar eingesammelt, um traditionelle Unternehmen zu übernehmen und KI zu implementieren, mit Expansion über Buchhaltung und IT hinaus.

Gemini Marktanteil sinkt. Marktdaten von Pangram, OpenRouter und Similarweb zeigen einen Rückgang der Gemini-Nutzung, wobei Pangram einen Rückgang auf 1,9 % der KI-Schreibarbeiten verzeichnet, während OpenAI über 50 % hält.

Claude für Legal. Anthropic hat den Legal-KI-Gründer Robert Mahari als ersten Head of Claude for Legal eingestellt und baut damit auf früheren Legal-Plugins und Partnerschaften auf.

Politik, Sicherheit & Gesellschaft

LiteLLM Supply-Chain-Leak. Ein Supply-Chain-Angriff auf LiteLLM legte Terabytes an Zugangsdaten von über 2.500 Organisationen offen, darunter Microsoft, Amazon und Samsung, über bösartige PyPI-Pakete.

Claude Ausgabe-Wasserzeichen. Anthropic markiert Claude-Ausgaben nun mit Wasserzeichen, um den EU AI Act einzuhalten, was Nutzer verärgert, die befürchten, dass es die KI-Nutzung bei der Arbeit oder in der Schule offenbart.

Twitch trainiert standardmäßig. Twitch wird Amazon-KI-Modelle standardmäßig mit Streamer-Inhalten trainieren, wobei jetzt ein Opt-out-Schalter verfügbar ist; die Richtlinie hat Gegenwind ausgelöst.

ShieldFont ersetzt Text. Designer haben ShieldFont veröffentlicht, eine Schriftart, die Benutzern normalen Text anzeigt, aber Wörter im zugrunde liegenden HTML ersetzt, um Scraper zu vergiften.

Hinton, Li, Ng über offene KI. Bei Ai4 argumentierten Geoffrey Hinton, Fei-Fei Li und Andrew Ng dafür, KI offen zu halten, um zu vermeiden, dass einige wenige Unternehmen den Zugang kontrollieren, trotz Sicherheitsbedenken bezüglich offener Gewichte.

Seltene Bücher zerstört. Buchhändler befürchten, dass KI-Unternehmen seltene Bücher kaufen und für das Training zerstören, obwohl es nicht-destruktive Scan-Alternativen gibt.

Forschung & Benchmarks

MindTopo Topologie-Reasoning. Der MindTopo-Benchmark von Microsoft Research zeigt, dass multimodale Modelle gut bei statischer topologischer Erkennung sind, aber Probleme mit interaktiver Planung haben, die das Aufrechterhalten von Beziehungen über die Zeit erfordert.

Prompts aus Ausgabe rekonstruiert. IIT Bombay und Adobe Research haben Previous-Token Prediction entwickelt, das LLM-Prompts aus Ausgabentext mit nahezu perfekter Genauigkeit ohne Modellgewichte rekonstruieren kann.

Das war alles für heute - etwa 5 Minuten Lesezeit.

Lesen Sie es jeden Morgen direkt in Ihrem Browser

Die Erweiterung öffnet diese Zusammenfassung im Seitenfenster von Chrome – ein Klick, kein Konto.

Zu Chrome hinzufügen – Kostenlos