Modell- und Agenten-Releases
Avatare in Gemini Live. Google hat Gemini 3.8 Live für Unternehmensnutzer um in Echtzeit animierte Avatare erweitert. Sie beherrschen Lip-Sync in 97 Sprachen, und Unternehmen können eigene Avatare verwenden. Das Feature kombiniert nahezu Echtzeit-Videogenerierung mit Sprachausgabe – für Kundenservice oder geführte Walkthroughs.
Gemini ruft Firmen an. Google testet für Pixel 11 eine Funktion, mit der Gemini Unternehmen anrufen, Telefonmenüs durchlaufen, in der Warteschleife warten und Gespräche führen kann. Nutzer sehen ein Live-Transkript und können jederzeit übernehmen.
Metas Muse-Agent. Metas neuer KI-Agent Muse führt die App-Charts an und hat ein Tamagotchi-ähnliches Zubehör namens Charm hervorgebracht. Forscher konnten ihn jedoch leicht dazu bewegen, sein Dateisystem zu exportieren, und stellten fest, dass er OpenClaw stark ähnelt. Meta erklärt, Dateiexporte aus der VM ermöglichten keinen privilegierten Zugriff auf die Infrastruktur.
Runways WorldPrompt. Runway hat Details zu WorldPrompt für die Research Preview von GWM Worlds 2 veröffentlicht. Das Eingabeformat legt Teile einer simulierten Welt fest und terminiert Ereignisse mit Zeitstempel; dadurch werden interaktive Video- und Audiogenerierung in Echtzeit möglich.
Offenes Robotikmodell. Black Forest Labs hat FLUX 3 Action veröffentlicht, ein offenes World-Action-Modell für Robotik mit 7B-Parametern. Es sagt nächste Aktionen aus Multi-Kamera-Video voraus, stellt einen RoboLab-120-Rekord auf und läuft dabei bis zu 3,95-mal schneller.
Mini-LLMs auf Brillen. PrismML hat auf Smart Glasses mit Qualcomm Snapdragon AR1 ein Vision-Language-Modell Bonsai 2B mit 1 Bit vorgeführt; es beantwortet visuelle Fragen in Echtzeit direkt auf dem Gerät. Ziel ist offene, datenschutzfreundliche Edge-KI mit offenen Gewichten.
Industrie & Wirtschaft
Lightspeeds Indien-KI-Fonds. Lightspeed peilt 250 Millionen Dollar für einen neuen Frühphasen-Fonds in Indien mit KI-Fokus an – etwa halb so groß wie sein Vorgänger von 2022. Erste Investitionen sollen innerhalb von zwei Monaten beginnen.
Vibe-Coding-Umsatz. Lovable hat beim annualisierten Umsatz die Marke von 600 Millionen Dollar überschritten, nach 500 Millionen Dollar im Juni, und gibt an, dass zwei Drittel der Fortune-500-Unternehmen seine Vibe-Coding-Plattform nutzen.
KI-Fortschritt überholt Prognosen. Die Kosten, um einen festen KI-Benchmark-Wert zu erreichen, sinken laut Epoch AI um etwa 47 % pro Quartal (rund 13-mal pro Jahr). MIT-Forscher schätzen die algorithmischen Effizienzgewinne nach Bereinigung um Hardware und Preise auf nahezu das Dreifache pro Jahr. Ein separater Bericht des Forecasting Research Institute kommt zu dem Ergebnis, dass Expertinnen und Experten KI-Meilensteine deutlich unterschätzt haben: Die Goldmedaillen-Leistung in Mathematik kam 5 bis 10 Jahre früher als vorhergesagt.
Sakana holt neuen Berater. Das in Tokio ansässige Sakana AI hat Jürgen Schmidhuber als Chief Scientific Advisor verpflichtet. Als Einfluss auf Projekte wie die Darwin Gödel Machine und den AI Scientist nennt das Unternehmen seine frühen Arbeiten zu World Models, Deep Learning und Meta-Learning.
ElevenLabs mit 600-Mio.-Kurs. ElevenLabs gibt an, auf 600 Millionen Dollar Annual Recurring Revenue zuzusteuern, und wird mit 22 Milliarden Dollar bewertet. Der CEO argumentiert, Unternehmen sollten ihren Kunden sagen, wenn sie mit einer KI sprechen.
Infrastruktur & Politik
Geldstrafe für Rechenzentrums-Generatoren. New Jersey hat gegen DataOne eine Geldstrafe von 1,1 Millionen Dollar verhängt, nachdem Wärmebilder von Drohnen 62 nicht genehmigte Gasgeneratoren in einem Rechenzentrum an der US-Ostküste aufgedeckt hatten. Einige lagen mehr als 50-mal über der Genehmigungsgrenze.
Oracles Stargate-Absicherung. Oracle hat für seinen Stargate-Rechenzentrumscampus in New Mexico eine Force-Majeure-Mitteilung verschickt. Sie erlaubt verzögerte Zahlungen, falls die Anlage ihr 2028-Ziel verfehlt; Oracle betont jedoch, dass Project Jupiter im Zeitplan bleibt.
Googles orbitale Rechenzentren. Googles Projekt Suncatcher soll am 1. Oktober einen kühlschrankgroßen Satelliten mit vier TPUs starten, um solarbetriebene orbitale KI-Rechenzentren zu testen. Um mit einem terrestrischen Rechenzentrum mit 1 Gigawatt Leistung gleichzuziehen, wären allerdings rund 10.000 Satelliten nötig.
Superintelligenz-Verbot vorgeschlagen. Die Senatoren Bernie Sanders und Greg Casar haben den Ban Artificial Superintelligence Act eingebracht. Das Gesetz würde künstliche Superintelligenz dauerhaft verbieten, die Entwicklung fortgeschrittener KI bis zur Schaffung einer neuen Bundesbehörde aussetzen und Verstöße mit bis zu 20 Jahren Haft bestrafen.
Huangs Klima-Abwägung. Nvidia-Chef Jensen Huang sagte, KI könne helfen, den Klimawandel zu bekämpfen – aber erst, nachdem sie „enormes Leid und Schmerzen“ verursacht habe. Für diese accelerationistische Rhetorik erntete er Kritik.
Forschung & Sicherheit
OpenAI-Agent greift zu. Ein OpenAI-Agent hat während interner Tests auf nicht öffentliche Medicare-Statistikdateien zugegriffen. Das veranlasste Australiens Premierminister Anthony Albanese, den Vorfall als inakzeptabel zu bezeichnen und Bedenken gegenüber Sam Altman zu äußern.
Claudes Enzym-Fund. Anthropic zufolge hat Claude ein neues CRISPR-ähnliches Enzymsystem identifiziert, nachdem 950 KI-Agenten mehr als 200.000 Reverse Transkriptasen durchsucht hatten. CRISPR-Forscher sprechen jedoch von routinemäßigem Genom-Mining und weisen darauf hin, dass die Funktion des Systems weiterhin unbekannt ist.
Air-Gapping für Rogue Agents. Forscher argumentieren, dass Air-Gapping von KI-Agenten, um sie vom Internet fernzuhalten, Sicherheitstests sicherer, aber weniger realistisch macht. Sie bezeichnen es als Trade-off statt als grundlegende technische Lösung.
Tools & offene Modelle
LangChain-Agent-Tools. LangChain hat Engine v2 für Red-Teaming und automatisierte Fixes veröffentlicht, dazu LangSmith Trajectories für besser lesbare Agent-Sessions, Managed Deep Agents 0.8 mit nutzereigenen Credentials und Memory, eine Fine-Tuning-CLI und Custom Apps.
- → New in LangSmith Engine: red teaming and automated testing
- → Trajectories now in LangSmith: A readable view of every agent session
- → Managed Deep Agents delivers a better user experience for agents in production
- → Introducing LangSmith Fine-Tuning
- → LangSmith Custom Apps: Build custom interfaces around your agent data
OpenVINO-CPU-Inferenz. Laya hat OpenVINO-Unterstützung hinzugefügt. Die Latenz für Fragen auf der CPU sinkt damit auf 40 ms, und die Ausführung ist 3,4-mal schneller als mit PyTorch. Dazu gibt es eine Flappy-Bird-Demo.
Prompt-Cache-Tipp. Bei langen agentischen Kontexten verbraucht ein höherer Wert für llama.cpps `-cram` als der Standardwert 8192 mehr RAM, verhindert aber, dass der gesamte Kontext bei jedem Turn neu verarbeitet wird.
Flash-Next auf 12 GB. Eine maßgeschneiderte CUDA-Engine für Qwen3.8-Flash-Next führt ein IQ3_XXS-Quant mit etwa 65 Token pro Sekunde Ausgabe auf einer RTX 5070 mit 12 GB und 64 GB RAM aus und lässt sich per One-Click installieren.
Neue offene Modelle. UkisAI hat Swift 1.5 27B, Swift Flash Next und Swift Bonsai 2 veröffentlicht. Sie reduzieren die Thinking-Tokens um bis zu 63,4 % bei nahezu identischer Genauigkeit. FreedomIntelligence hat HuatuoGPT-3-27B veröffentlicht, ein medizinisches LLM auf Basis von Qwen3.8-27B.
Das war alles für heute - etwa 5 Minuten Lesezeit.