Modell-Releases & Benchmarks
Gemini 3.8 Flash. Google hat innerhalb von sechs Wochen sein drittes Flash-Modell veröffentlicht. Reasoning, Coding und agentische Tool-Nutzung wurden verbessert. Der Preis pro Token bleibt unverändert, allerdings verbraucht das Modell womöglich mehr Token. Eine Cyber-Variante steht vertrauenswürdigen Verteidigern über das neue Fairwind-Programm zur Verfügung.
- → Google releases Gemini 3.8 Flash, its third Flash model in six weeks
- → Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
- → Proactive cyber defense for governments and enterprises
- → Proactive cyber defense for governments and enterprises
- → Gemini 3.8 Flash is Google's third budget model in six weeks while frontier models remain MIA
- → Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost more
- → llm-gemini 0.34
Muse Spark 1.3. Metas Open-Weights-Modell liegt auf AAII jetzt auf Platz drei und ist damit gleichauf mit GPT-5.6-Sol. Wenn Nutzer zustimmen, ist das Training über 90 % günstiger. Open Weights sind zugesagt; Nutzer warten auf kleinere Varianten zwischen Glimmer und Spark.
GLM-5.3 vs. DeepSeek-V4. Vergleiche aus der Community auf Mac Studio und DGX Spark zeigen: GLM 5.3 Flash kommt schneller zu Ergebnissen und ist in Sachen Schreiben und Vision besser, während DeepSeek V4 Flash mehr Token pro Sekunde und einen längeren Kontext bietet. Für DeepSeek-V4-Flash-Vision-Exp sind jetzt Vision-Unterstützung und GGUF-Dateien verfügbar.
Lokale KI & Open Source
Qwen3.8 Flash Next tuning. Ein Expert-Cache-PR verbessert die Decode-Geschwindigkeit auf Dual-3090-Systemen von 17 auf 25–29 Token/s. Neue AP-Quants und Q8-N-Gram-Bolting zeigen keine Geschwindigkeitsverluste. Außerdem berichten Nutzer von Plan-Halluzinationen und Kontextkorruption, was auf Preview-Qualität hindeutet.
Perplexity Lily. Perplexity hat seinen für Qwen 3.6 auf Apple Silicon optimierten Mac-Inferenzserver als Open Source veröffentlicht. Dabei konzentriert er sich auf ein einzelnes Modell, um die beste Leistung zu erzielen.
Lokale Sprach-Tools. VoxGen bringt Rust/Vulkan-TTS für VoxCPM2; auf AMD-Hardware läuft es flüssig. Microsoft hat VibeVoice ASR streaming veröffentlicht. Zudem teilen Nutzer Mac Parakeet plus Whisper/Parakeet als funktionierendes STT-Setup fürs Programmieren.
GLM-Minecraft-Mod. Ein lokales GLM 5.3 Flash Q4 hat auf vier RTX-PRO-6000-Karten in mehreren Iterationen ein Black-Hole-Rifle-Mod für Minecraft gebaut. Zum Einsatz kam die Fabric API.
Forschung & Weltmodelle
World Labs Atlas. World Labs hat Atlas vorgestellt – ein einzelnes Modell, das aus nur wenigen Fotos 3D-Szenen erzeugt, rekonstruiert und simuliert. Es nutzt räumlichen Kontext, um jede Eingabe im 3D-Raum zu verankern.
H3-World-Sprachsteuerung. H3-World fasst Charakter- und Kamerabewegungen zu textuellen Anweisungen zusammen, die über den Textpfad von MiniMax-H3 eingespeist werden. Damit lassen sich Spielbewegungen steuern. Dafür genügen 8.000 Samples, und trainierbar sind nur 0,199 % der Parameter.
Sicherheit, Politik & Recht
Sicherheitsbedenken zu Astra. OpenAIs kommendes Astra arbeitet mit einer undurchsichtigen Rekurrenz, wodurch sich Chain-of-Thought schwerer überwachen lässt. Zudem wird es bei Cyber-Fähigkeiten als „kritisch“ eingestuft. Sicherheitsexperten warnen vor einem Wettlauf nach unten.
US-Regierung stützt Fair Use. Die US-Regierung hat sich im Rechtsstreit mit der New York Times auf die Seite von OpenAI gestellt. Sie argumentiert, das Training von LLMs mit urheberrechtlich geschütztem Text sei Fair Use und von den Modellausgaben zu unterscheiden. So solle die amerikanische KI-Führungsrolle erhalten bleiben.
Geheime KI-Sicherheitsregeln. Eine Klage will die Trump-Administration zwingen, ihren geheimen Rahmen für Sicherheitsüberprüfungen von Frontier-KI vor der Freigabe offenzulegen. Bislang fehlt es an Transparenz gegenüber der Öffentlichkeit und dem Kongress.
KI-Verbot an New Yorker Schulen. New York City hat KI für Schülerinnen und Schüler bis zur 8. Klasse und Begleit-Chatbots in allen Klassenstufen verboten. An der High School ist die KI-Nutzung eingeschränkt möglich; außerdem gibt es Unterricht zur KI-Kompetenz.
Tumbler-Ridge-Klagen. 30 neue Klagen werfen OpenAI vor, Beihilfe zum Amoklauf an einer Schule in Tumbler Ridge geleistet zu haben. Das Unternehmen soll Sicherheitswarnungen zu den ChatGPT-Gesprächen des Verdächtigen ignoriert haben.
Business & Unternehmen
Palo Alto kauft Console. Palo Alto Networks hat das KI-Agenten-Start-up Console für 500 Millionen US-Dollar übernommen. Console automatisiert IT-Helpdesk-Aufgaben. Mit dem Zukauf will Palo Alto seiner Cortex-Plattform autonome Sicherheitsergebnisse hinzufügen.
HiddenLayer sammelt 100 Mio. Dollar. Das KI-Sicherheits-Start-up HiddenLayer hat 100 Millionen US-Dollar eingesammelt. Unternehmen geben inzwischen mehr aus, um KI-Modelle, Agenten und Workflows vor Adversarial-Angriffen zu schützen.
Wonderful erreicht 5 Mrd. Dollar. Das KI-OS-Start-up Wonderful hat 550 Millionen US-Dollar eingesammelt und seine Bewertung damit auf 5 Milliarden US-Dollar verdoppelt. Es expandiert von Customer-Service-Agenten zur Koordination von Workflows in 35 Ländern.
Skalierung von Enterprise-Agenten. Schneider Electric, Vodafone und monday.com haben festgestellt, dass sich Agenten zwar leicht prototypisieren, aber nur schwer betreiben lassen. Deshalb haben sie Infrastrukturschichten für Observability, Evaluierung und Deployment aufgebaut.
Betrugserkennung bei Alexa. Amazons Alexa for Shopping gleicht eine eingehende Nachricht nun mit den von Amazon tatsächlich gesendeten Nachrichten ab, um festzustellen, ob sie echt ist. Das hilft Nutzern, Täuschungsversuche zu erkennen, bei denen sich Kriminelle als Amazon ausgeben.
Das war alles für heute - etwa 5 Minuten Lesezeit.