Modell-Releases & Updates
Ox Alpha als Stealth-Modell. Ein neues Stealth-Modell namens Ox Alpha scheint auf GLM oder Mimo zu basieren, doch Details sind unbestätigt. Es wird als Frontier-Modell für effizientes Coding, dauerhafte Agenten-Arbeit und Produktionseinsatz beschrieben.
SenseNova U1.5-Lite. SenseNova hat U1.5-Lite veröffentlicht, ein einziges vereinheitlichtes Modell, das aufgabenspezifische Experten für Textdarstellung, Ästhetik und Bildbearbeitung zusammenfasst. Es verbessert das Befolgen komplexer Anweisungen, native 4K-Generierung und die Bearbeitungstreue.
Tencent Hunyuan Hy4. Tencent hat mit Grautests seines neuen Flaggschiffs Hunyuan Hy4 in der Yuanbao-App begonnen. Es wird als Expertenmodell mit Tool-Nutzung eingestuft und oberhalb von Hy3 und DeepSeek positioniert.
Anthropic Model 2 intern. Anthropics Risikobericht zeigt, dass sein leistungsfähigstes Modell mit dem Codenamen Model 2 nur für den internen Gebrauch bestimmt ist. Es übertrifft die öffentlichen Claude-Modelle und wird intensiv für Programmierung und Forschung genutzt.
Ling-3.0-Basis-Checkpoints. AntLing hat sechs Basis-Checkpoints für Ling-3.0 in zwei Größen und drei Trainingsstufen veröffentlicht. Sie sind alle unter MIT-Lizenz und für weiteres Vortraining und Forschung gedacht.
Agenten-Produkte & Plattformen
ChatGPT-Plug-in für Messages. OpenAI hat ein Plug-in für Apple Messages veröffentlicht, mit dem ChatGPT Nachrichten analysieren, entwerfen und senden kann. Es arbeitet mit Codex und ChatGPT Work zusammen. Details zum Datenschutz sind noch unklar.
Meta-KI-App für Mac. Meta hat eine Mac-App mit systemweiter Diktierfunktion und Screen-Awareness über Muse Spark veröffentlicht. Außerdem kamen Business-Integrationen für Anzeigen und Google Workspace hinzu.
Slack-Code-Kanäle. Slack hat kollaborative Vibe-Coding-Kanäle eingeführt. Teams können dort KI-Agenten wie Claude oder Devin erwähnen, Diffs prüfen und Ausgaben vor der Veröffentlichung ansehen.
Binance Agent OS. Binance hat Agent OS gestartet, eine Plattform, auf der KI-Agenten Märkte analysieren und Trades ausführen können. Sie unterstützt vom Nutzer festgelegte Limits und MCP.
Ramp bringt Router heraus. Ramp hat Router gestartet, einen Routing-Dienst für KI-Modelle, der Zugang zu mehreren LLM-Anbietern und Strategien bietet. Bis Ende 2026 ist er kostenlos.
Tools & Frameworks
LangSmith Preview Builds. LangSmith hat Preview Builds eingeführt. Teams können damit Agenten-Änderungen aus PR-Branches vor dem Merge in isolierten produktionsähnlichen Umgebungen testen.
NVIDIA CUDA MCP. NVIDIA hat einen gehosteten CUDA-MCP-Server für KI-gestützte CUDA-Aufgaben veröffentlicht, etwa das Durchsuchen offizieller Dokumentationen, das Schreiben optimierten GPU-Codes und die Leistungsanalyse.
/wayfinder-Skill. Matt Pocock hat /wayfinder veröffentlicht, einen Skill, der Agenten bei der Planung von Projekten mit unklarem Endzustand hilft. Er adressiert die Planung im „Fog of War“.
LFM2.5-DSpark. Hugging Face hat DSpark für LFM2.5-Modelle angekündigt. Es erreicht eine bis zu 3,2-mal schnellere Inferenz auf der GPU und 2,87-mal auf dem Gerät, bei 57 Prozent geringerer Function-Calling-Latenz.
Forschung & Benchmarks
Qwen3.8-27B-Leistung. Ein Entwickler hat Qwen3.8-27B auf einer RTX 3090 auf 381 Tokens pro Sekunde optimiert. Im Benchmark erreicht das Modell mit FP8 und hohem Reasoning 29 von 30 Punkten bei AIME 2026 und zieht damit mit Claude Opus 4.6 gleich.
GEN-1.5: One-Shot-Roboter. Generalist AIs GEN-1.5 bringt Robotern neue Aufgaben anhand einer einzigen 3 bis 12 Sekunden langen Demonstration bei. Die Erfolgsquote liegt im Schnitt bei 59 Prozent, mit zehn Trainingsschritten bei 83 Prozent.
KI-geschriebene Webseiten. Pew Research hat festgestellt, dass mehr als ein Drittel der seit ChatGPT veröffentlichten Webseiten Anzeichen von KI-Autorenschaft zeigen. Grundlage ist die Pangram-Erkennung auf Common-Crawl-Daten.
Guardrails machen KI erkennbar. Post-Training-Guardrails verursachen einen Mode Collapse und machen LLM-Text erkennbar. Basismodelle und eng begrenzte Fine-Tunes entgehen der Erkennung, argumentiert der CTO von Pangram.
Sutton zu synthetischen Daten. Richard Sutton argumentiert, dass synthetische Daten das Scaling-Problem nicht lösen werden. Er nennt diesen Ansatz einen „großen Fehler“, weil die Welt unendlich komplex ist.
Tao zur Mathe-Krise. Terence Tao sagt, KI könnte die größte Mathematik-Krise seit Gödel auslösen. Das zwinge dazu, neu zu überdenken, was als mathematischer Beitrag zählt.
Industrie & Wirtschaft
Micro1-Datenboom. Das Startup Micro1 für KI-Trainingsdaten hat seine Brutto-Jahresumsatzrate in acht Monaten von 100 auf 500 Millionen Dollar gesteigert, bei einem Netto von etwa 150 bis 200 Millionen Dollar. Die Nachfrage nach einzigartigen KI-Trainingsdaten boomt.
OpenAI gegen Anthropic. Daten von Ramp zeigen, dass Anthropic bei US-Geschäftskunden mit 44 zu 40 Prozent vor OpenAI liegt. OpenAI wächst im dritten Quartal bislang jedoch schneller.
Runlayer/Rippling-Klage. Runlayer und Rippling haben ihre Klagen im Streit um den MCP-Gateway-Wettbewerb fallengelassen. Rippling feierte das, indem es seinen MCP-Gateway sofort veröffentlichte.
Brockmans OpenAI. Greg Brockman hat bei OpenAI leise an Macht gewonnen. Als Präsident führt er die täglichen Geschäfte, während Sam Altman CEO bleibt – vor dem Börsengang.
Chinas KI-Aufholjagd. Eine Decoder-Analyse argumentiert, dass Chinas Kimi K3 und GLM-5.3 den US-Modellen gefährlich nahe gekommen sind. Der Burggraben verschiebt sich dadurch vom Modellvorsprung zu anderen Faktoren.
Unitrees zirkuläre Finanzierung. Chinas Unitree wird beim Börsengang mit 50 Milliarden Dollar bewertet. Das beruht auf staatlich unterstützten Zentren, die Roboter kaufen und Trainingsdaten zurückverkaufen – was Fragen zu zirkulärer Finanzierung aufwirft.
Sicherheit & Zuverlässigkeit
Grok-Prompt-Injection-Angriff. Forscher haben gezeigt, dass Grok Nutzerdaten exfiltriert, wenn bösartige Anweisungen verschlüsselt sind. xAI wurde im Juni informiert, das Problem besteht jedoch weiter.
Grok-Kauderwelsch-Bug. Grok hat auf Grok.com bei einigen Nutzern Kauderwelsch-Antworten ausgegeben. xAI bestätigte ein seltenes, vorübergehendes Generierungsproblem.
Das war alles für heute - etwa 5 Minuten Lesezeit.