Agentic AI News Heute

Die Nachrichten über KI-Agenten des Tages in einer 5-minütigen Lektüre: Veröffentlichungen, Tools, Forschung, Finanzierung und Unternehmensentwicklungen.

Täglich aktualisiert zusammengestellt aus 30 Quellen Donnerstag, Oktober 8, 2026

Modelle & Schnittstellen

Claude Haiku 5.5. Anthropics neues schnelles, günstiges Modell bietet 1 Mio. Token Kontext und senkt den Prompt-Preis auf 0,10 US-Dollar pro Million bis 100.000 Token – damit liegt es auf dem Niveau von GPT-6 Luna. Allerdings zählt sein Tokenizer rund 25 bis 30 % mehr Token, und ab 100.000 Token steigen die Preise auf das Fünffache. Die Benchmarks zeigen einen großen Sprung gegenüber Haiku 4.5 und konkurrenzfähiges agentisches Coding.

Mistral Large 4 „Le Chonk“. Mistral hat ein offenes Modell mit 1 Billion Parametern als Preview veröffentlicht, optimiert für Coding, Cyberverteidigung und einzelne Branchen. Das Unternehmen beansprucht Fähigkeiten nahe den Frontier-Modellen aus den USA und China.

Decision-Models von Liquid AI. Liquid AI hat d1-3B und d1-omni-600M als Open Source freigegeben: multimodale Entscheidungsmodelle, die kalibrierte Ja/Nein-, Auswahl- oder Score-Antworten ganz ohne Output-Token liefern. d1-3B beansprucht im Decision Index den Bestwert unter 10B und läuft auf NVIDIA-Jetson-Hardware in nur 16 ms; ein WebGPU-Port für den Browser ist ebenfalls aufgetaucht.

OpenAI Decisions API. OpenAI hat die Decisions API in der Beta gestartet. Sie liefert Ja/Nein-, kategorische und Skala-Bewertungen für Text oder Bilder und ist rund zehnmal schneller als Responses. Unterstützt wird GPT-6 Luna zu 0,10 US-Dollar pro Million Input-Token, die Output-Token sind kostenlos.

ChatGPT Intelligent UI. Mit GPT-6 gibt ChatGPT statt reinem Text auch interaktive Diagramme, Buttons, Formulare und Mini-Apps aus. Laut OpenAI setzt das Reasoning schon während des Denkens ein, um Wartezeiten zu verkürzen. Zahlende Nutzer bekommen GPT-6 Sol, kostenlose Nutzer Luna.

Kandinsky 6.0 für Video. Kandinsky Lab hat Kandinsky 6.0 Pro (29B) und Lite (3B) mit Unterstützung für ComfyUI und Diffusers veröffentlicht, dazu einen Video-Upscaler.

Nemotron bei IOI und IMO. Feinabgestimmte Nemotron-Modelle erreichten bei der IOI 2026 inoffiziell Gold-Niveau (535,4/600) und beim offiziellen IMO 2026 eine Gold-Wertung von 30/42 – mit SFT, RL und Generate-Verify-Refine.

Agenten & Frameworks

Agenten von Nous Research. Nous Research hat 90 Mio. US-Dollar bei einer Bewertung von 1,5 Mrd. US-Dollar eingesammelt und mit Hermes for Businesses ein Angebot für KI-Agenten in Unternehmen gestartet. Der Open-Source-Agent Hermes Agent wurde 24 Millionen Mal geklont und soll rund 2,5 % des weltweiten KI-Token-Verbrauchs ausmachen.

LangChain Deep Agents. LangChain hat Skills-Updates vorgestellt, die Tools an Skills binden, damit der Kontext klein bleibt. Dazu kommt Managed Deep Agents v0.9 mit von Agenten erstellten Zeitplänen, Konfiguration pro Lauf und Slack-Reaktionen.

Copilot-Aktionen in Windows. Microsofts Hybrid Intelligence soll Copilot Zugriff auf lokale Dateien geben und Aktionen in ganz Windows erlauben – etwa Dokumente für Nutzer suchen, umbenennen, zippen und per E-Mail versenden.

Meta Muse auf dem iPad. Metas Agenten-Assistent Muse unterstützt jetzt nativ das iPad, nachdem er 6,6 Millionen Installationen erreicht hat. Hinzu kommen Konnektoren für Tools wie Canva, GitHub und QuickBooks.

Agent Lightning v1.0. Microsoft Research hat Agent Lightning v1.0 als Open Source veröffentlicht, ein 3.500 Zeilen umfassendes RL-Framework für Agenten, das echte Deployment-Harnesses und natives Kubernetes nutzt. In einem Beispiel hob es Pass@1 von Qwen3.5-9B auf SWE-bench Verified von 41,8 % auf 56,4 % – mit rund 6.000 Trainingsbeispielen.

Lokale KI & Entwickler-Tools

ROCm 10.1. AMDs ROCm 10.1 zielt auf den Engpass bei der Datenbewegung in der lokalen Inferenz; das Release wird von Nutzern lokaler KI auf Reddit diskutiert.

llama.cpp beschleunigt MoE. llama.cpp hat einen GPU-Cache für MoE-Experten bekommen, die im Host-Speicher liegen – das verspricht kräftige Geschwindigkeitsgewinne bei Modellen, die nicht komplett in den VRAM passen. Dazu kommt Unterstützung für GLM5Next MTP.

Unsloth Studio prüft Repos. Unsloth Studio prüft vertrauenswürdige Modell-Repositories jetzt vor der Ausführung erneut. Auslöser waren kompromittierte LiteLLM-Versionen auf PyPI, die zeigen, wie Supply-Chain-Angriffe bis ins KI-Tooling reichen können.

GLM-5.3-Flash auf zwei GPUs. Ein Setup aus zwei CMP 170HX mit 64 GB betreibt GLM-5.3-Flash mit 384K Kontext und rund 90 Token/s über EXL3. Das 320B-MoE hält die aktiven Gewichte im HBM und wird gegen Qwen3.8-Flash-Next gebencht.

Lokale Qwen-Benchmarks. Neuere Community-Auswertungen vergleichen Qwen3.8-27B-Fine-Tunes und Qwen3.8-Flash-Next mit Frontier-Modellen bei domänenspezifischen und Coding-Aufgaben. Ein Eval mit 469 Fragen kommt zu dem Ergebnis, dass lokale Modelle mit Datenschutz und geringeren Kosten an Frontier-Ergebnisse heranreichen können – übermäßig viele Thinking-Token bleiben aber ein Problem.

Hardware & Windows

Surface-KI-Hardware. Microsoft hat das Surface Laptop Ultra und die Surface RTX Spark Dev Box angekündigt, beide auf Nvidias Arm-basiertem RTX Spark Chip. Das Laptop startet bei 2.599 US-Dollar, bietet bis zu 128 GB Unified Memory und wird ab dem 16. Oktober ausgeliefert; die Dev Box beginnt bei 5.999 US-Dollar und ist auf lokale Modelle mit 120B+ ausgelegt.

Branche & Wirtschaft

Engpass Debugging. Eine Umfrage unter 300 leitenden Engineering-Verantwortlichen zeigt, dass KI-Coding-Agenten den Engpass zu Debugging und Verständnis verschoben haben: Teams verbringen heute 9,8 Stunden pro Woche mit dem Schreiben von Code, aber 16,9 Stunden pro Woche mit dessen Fehlersuche. Der Bericht hebt ein wachsendes Risiko in geschäftskritischen Codebasen hervor.

Initiative Virtuelle Zelle. Biohub koordiniert eine Initiative von 1,8 Mrd. US-Dollar für KI-Modelle, die Zellverhalten vorhersagen. Google DeepMind, Meta und Isomorphic Labs steuern 300 Mio. US-Dollar bei, das US-Energieministerium (DOE) mehr als 500 Mio. US-Dollar für Labormessungen und Rechenleistung.

Adobe-Klone als Open Source. Der Entwickler Brandon Thomas hat mit Claude Opus 5.5 Artcraft gebaut, eine Suite aus sieben Open-Source-Apps in Rust/WebAssembly, die Adobes Photoshop, Illustrator, Premiere und weitere Programme nachbilden. Die Apps sind früh und haben noch viele Schwächen, doch das Projekt zeigt eine KI-gestützte Clean-Room-Reimplementierung.

SynthID für alle. Google hat seinen SynthID-Detektor für die Öffentlichkeit geöffnet: Jeder kann Bilder, Videos und Audio auf Wasserzeichen von Google oder Partnern prüfen. Das System hat bereits mehr als 180 Milliarden Medienobjekte markiert und steckt auch in Chrome und Gemini.

Spiele in Google Playground. Google Labs hat Playground gestartet, eine browserbasierte Plattform, auf der Erwachsene in den USA aus Text-Prompts Spiele erstellen können – angetrieben von Gemini, Nano Banana und Lyria. Unity hat außerdem Unity Spark für professionelle KI-gestützte Spieleentwicklung angekündigt.

Das war alles für heute - etwa 5 Minuten Lesezeit.

Lesen Sie es jeden Morgen direkt in Ihrem Browser

Die Erweiterung öffnet diese Zusammenfassung im Seitenfenster von Chrome – ein Klick, kein Konto.

Zu Chrome hinzufügen – Kostenlos