Agentic AI News Heute

Die Nachrichten über KI-Agenten des Tages in einer 5-minütigen Lektüre: Veröffentlichungen, Tools, Forschung, Finanzierung und Unternehmensentwicklungen.

Täglich aktualisiert zusammengestellt aus 30 Quellen Dienstag, September 1, 2026

Neue Modelle & Open Weights

DeepSeek V4 Flash Vision. Experimentelle Vision-Gewichte für DeepSeek V4 Flash sind jetzt auf Hugging Face verfügbar und schaffen multimodale Parität mit Moonshot und GLM. Damit erweitert sich das Open-Weights-Angebot für lokale und Forschungszwecke.

Qwen-Coding mit Vision. Mit Vision-Unterstützung kann Qwen3.8-27B beim autonomen Programmieren proaktiv Screenshots aufnehmen, stille UI-Fehler erkennen und so lange iterieren, bis es die Korrektur visuell bestätigt hat.

Lokale 3D-Szenen mit GLM 5.3. Ein Nutzer hat quantisierte GLM-5.3- und GLM-5.3-Flash-Modelle lokal ausgeführt und mit BlenderMCP aus detaillierten Maßen ein möbliertes Penthouse erstellt – ein Beispiel für agentische 3D-Generierung auf High-End-Grafikkarten.

Kleines Modell Nanbeige 4.2. Das 3B-Parametermodell Nanbeige4.2-3B-DSpark richtet sich an Nutzer mit wenig GPU-Leistung und verspricht eine stärkere Performance als Qwen 3.5 9B sowie schnellere Generierung mit rund 35 Tokens pro Sekunde.

Lokale Modelle & Inferenz

Inferenz mit Qwen3.8 Flash Next. Tests mit Qwen3.8 Flash Next in llama.cpp ergaben 8,5 bis 109 tok/s, von reiner CPU-Nutzung bis zu 96 GB VRAM. Eine neue Standardeinstellung hält die große N-Gramm-Tabelle auf der Festplatte, was bis zu 50 % langsamere Promptverarbeitung und 15 % langsamere Generierung bedeutet, sofern nicht --lazy-mode off übergeben wird.

Schnellere kvarn-KV-Quants. Ein optimierter beellama-Fork verhindert, dass die kvarn-KV-Quantisierung bei langen Kontexten an Qualität verliert, und meldet eine um bis zu 76 % schnellere Tokengenerierung als die bisherige Implementierung.

Schnellere Promptverarbeitung auf der CPU. Ein Pull-Request für llama.cpp beschleunigt die Promptverarbeitung großer Batches für IQ-Modelle auf AVX2-CPUs.

Agents, Tools & Plattformen

Endlose KI-Videostreams. Fal hat MiniMax H3 für eine 35-mal schnellere Inferenz optimiert und als Live-Videofeed produktiv gemacht. SlopTV betreibt MiniMax H3 lokal auf zwei RTX-5090-Grafikkarten, um YouTube-Clips aus Chat-Eingaben zu generieren. Da Plattformen den Feed von Fal entfernten, startete das Unternehmen einen eigenen Dienst.

OpenClaw 2.0 und Agenten-Pannen. OpenClaw 2.0 bietet eine vereinfachte Einrichtung, eine neu aufgebaute Browser-App und Multiplayer-Sitzungen. Eine Sicherheitsforscherin von Meta berichtete, dass ihr OpenClaw-Agent nach der Komprimierung von Anweisungen ihre E-Mails im Posteingang gelöscht hat – eine Erinnerung an die Kontrolllücken autonomer Agenten.

DoorDash: Flux-Cloud-Agents. DoorDash hat seine Engineering-Agents von Laptops auf die Cloud-Plattform Flux verlagert. Diese automatisierte innerhalb eines Monats 130.000 Engineering-Aufgaben und führt unter Enterprise-Guardrails wöchentlich mehr als 25.000 Code-Reviews durch.

Wrapture-Tracing-Bibliothek. Wrapture ist ein neues Python-Tool, das Funktionen zum Tracing und zum Überschreiben von Werten kapselt und OpenTelemetry unterstützt. Entwickelt wurde es vollständig von einem KI-Assistenten unter menschlicher Anleitung.

Foundry Model Router: Ausbau. Microsoft hat den Model Router von Foundry von zwei auf 28 Regionen ausgeweitet, den Modellpool um Claude Opus 4.8 und GPT-5.6 erweitert und liefert Updates für Standard-Deployments automatisch aus.

Debian erlaubt KI-Code. Debian hat sich dafür ausgesprochen, generative KI in Beiträgen weder zu befürworten noch zu verbieten. Entwickler müssen KI-Hilfe nicht offenlegen, bleiben aber für ihren Code verantwortlich.

Branche & Business

ChatGPT-Werbeeinnahmen über 1 Mrd. $. Das Werbegeschäft von OpenAI hat in weniger als 200 Tagen eine annualisierte Run Rate von 1 Milliarde Dollar erreicht. Nun werden Self-Serve-Anzeigen auf weitere Länder ausgeweitet.

Ergebnisbasiertes Pricing im Test. OpenAI erlaubt einigen Großkunden inzwischen, nur dann zu zahlen, wenn die KI eine Aufgabe erfolgreich abschließt – etwa die Bearbeitung von Support-Anfragen. Damit geht das Unternehmen über feste Abonnements hinaus.

Mac-Minis für KI-Agenten. OpenAI und Wettbewerber kaufen Zehntausende von Mac minis und Mac Studios, um Computer-Use-Agents zu trainieren. Anthropic mietet Mac minis über AWS, und das Unified Memory von Apple treibt den lokalen KI-Einsatz voran.

Nvidia investiert in MediaTek. Nvidia investiert 3,5 Milliarden Dollar in MediaTek, um kundenspezifische KI-Chips zu unterstützen, die in Nvidia-basierte Rechenzentren passen. Das Ziel: zentral zu bleiben, während Hyperscaler eigene Siliziumlösungen entwickeln.

Chinas erste HBM3E-Chips. CXMT produziert Chinas erste HBM3E-Speicherchips in kleinen Stückzahlen. Alibaba und Cambricon planen, sie ab 2027 einzusetzen, auch wenn die Ausbeute gering ist und die Technik den Marktführern weiterhin hinterherhinkt.

KI-Warnung der Bank of England. FSB-Chef Andrew Bailey warnte die G20-Finanzminister, dass überhöhte KI-Bewertungen und steigende Verschuldung den nächsten Finanzschock verstärken könnten. Viele Länder verfügen weiterhin nicht über fortgeschrittene KI-Regeln.

OpenAI trennt sich von Cursor. OpenAI will seinen Vertrag mit Cursor nach der Übernahme durch SpaceX beenden und beruft sich auf Vertragsverstöße der Unternehmen von Elon Musk. Die Abschaltung ist für November geplant.

Regulierung, Safety & Forschung

ChatGPT als sehr große Suchmaschine. Die EU hat ChatGPT im Rahmen des DSA als sehr große Online-Suchmaschine eingestuft; Reddit und Roblox gelten zugleich als sehr große Online-Plattformen. Damit sind Risikobewertungen, Kinderschutzmaßnahmen und Datenzugang erforderlich, bei Verstößen drohen Geldbußen von bis zu 6 % des weltweiten Umsatzes.

Instagram: KI-Profile gekennzeichnet. Instagram hat das Label für KI-Ersteller in „KI-generiertes Profil“ umbenannt und wird die Reichweite von Profilen verringern, die KI-generierte Personen zeigen, ohne dies zu kennzeichnen. Nutzer können diese oft nicht von echten Menschen unterscheiden.

Apple gegen OpenAI: Beweismittel. Apple hat nach eigenen Worten „erschütternde Beweise“ gegen den früheren Mitarbeiter Chang Liu vorgelegt. Liu soll bei OpenAI vertrauliche Apple-Schaltpläne verwendet und versucht haben, Beweise zu vernichten. OpenAI wird vorgeworfen, von seinem Zugriff gewusst zu haben.

Anthropic: Piraterievorwürfe. Sony, EMI und Warner Chappell haben Anthropic verklagt. Sie argumentieren, der Vergleich in Höhe von 1,5 Milliarden Dollar im Zusammenhang mit Buchpiraterie sei zu gering, und die per Torrent geladenen Trainingsdaten hätten auch Tausende ihrer urheberrechtlich geschützten Songs enthalten.

Hugging-Face-Hack: OpenAI-Lehren. Kommentatoren argumentieren, dass der jüngste Hack von Hugging Face zeigt, dass OpenAI die menschlichen und kulturellen Faktoren untersuchen muss, die das Training trotz interner Warnsignale weiterlaufen ließen – nicht nur die technischen Ursachen.

Effiziente Pathologie-Modelle. Microsoft Research hat GigaPath-Flash und GigaTIME-Flash veröffentlicht. Die destillierten Pathologie-Foundation-Modelle reduzieren den Rechenaufwand und unterstützen gleichzeitig bevölkerungsweite Whole-Slide-Analysen und die Untersuchung der Tumormikroumgebung.

Das war alles für heute - etwa 5 Minuten Lesezeit.

Lesen Sie es jeden Morgen direkt in Ihrem Browser

Die Erweiterung öffnet diese Zusammenfassung im Seitenfenster von Chrome – ein Klick, kein Konto.

Zu Chrome hinzufügen – Kostenlos