Open- & lokale Modellveröffentlichungen
Ornith-1.5 offene Familie. Ornith-1.5 wurde in 9B dense, 35B MoE und 397B MoE unter MIT veröffentlicht, mit starken Agent- und Coding-Benchmarks; Community-Quantisierungen zeigen, dass die 35B mit 60 tk/s auf einer 12GB 4070 Ti läuft und die 9B frühere kleine Modelle übertrifft.
Praxisberichte zu Qwen3.8-27B. Lokale Nutzer berichten, dass Qwen3.8-27B autonom über 80 Tool-Aufrufe ausführen und lange agentische Ketten verarbeiten kann, aber sein Offline-Wissen und die strengen Codierwerte sind schwächer als bei Vorgängern, daher funktioniert es am besten mit klarer Anweisung oder als Copilot.
Qwen3.8 Beschleunigungen und Quantisierungen. Community-Bemühungen brachten Qwen3.8-27B auf 138 tps auf einer RTX 3090 mit DFlash2, veröffentlichten Dynamic V3 Quantisierungen, die eine 10% höhere Genauigkeit beanspruchen, ein tiefenbeschnittenes 22.7B Mini-Me, und nativen FP4 auf V100s von 2017, die einer 5090 entsprechen.
- → I pushed Qwen3.8-27B limits again... Dflash2 - 134 tps on a RTX 3090
- → DFlash2 speeds Qwen 3.8 27B up to 4 times
- → Introducing Qwen3.8-27B Dynamic v3 Unsloth GGUFs
- → updated unsloth/Qwen3.8-27B-GGUF · Hugging Face
- → Qwen3.8-23B-Mini-Me: A Depth-Pruned Qwen3.8-27B (to ~22.7BB)
- → NVFP4 on VOLTA! Despite being built for Blackwell, I made four 2017 V100s run Qwen 3.8 NVFP4 natively and match my $6000 RTX 5090.
Ling Basis-Checkpoints. AntLing hat Basis- und Midtrain-Checkpoints für Ling-3.0-tiny und flash ohne Post-Training als Open Source veröffentlicht, und ein Nutzer nutzt Ling tiny als Hilfsmittel zur Kontextkompression neben Qwen3.8.
LFM2.5 QAD Quantisierungen. Liquid AI veröffentlichte Q4_0 Checkpoints, die mit quantisierungsbewusster Destillation trainiert wurden und 97% der BF16-Genauigkeit bei gleicher Geschwindigkeit und gleichem Speicher wiederherstellen.
GLM-5.3 und Frontier-Veröffentlichungen. GLM-5.3 liegt gleichauf mit Kimi K3 an der Spitze der Open-Model-Rankings mit großen agentischen Verbesserungen und niedrigeren Kosten, obwohl sich die offenen Gewichte um zwei Wochen verzögern; DeepSeek V4-Pro GA und NVIDIA Nemotron 3.5 Lightning/NeMo Switchyard wurden ebenfalls veröffentlicht.
Agent-Tools & Produktupdates
Sichere Sandboxen. Simon Willison testete smolmachines/smolvm als Sandbox für nicht vertrauenswürdiges Python und JavaScript mit CPU-/RAM-Grenzen und ohne Netzwerk; Jeremy Morrell argumentiert, dass LLM-geschriebene Erweiterungen plus Sandbox-Primitive sichere erweiterbare Software ermöglichen.
Replit Gratismodus. Replit führte den Gratismodus ein, der von GPT-5.6 Luna unterstützt wird und es jedem ermöglicht, Apps und Agenten ohne Token-Kostenbeschränkungen zu erstellen.
Calendly AI-Notizen. Calendly ist in die Meeting-Notizen eingestiegen, mit Zusammenfassungen, Aktionspunkten und einem kommenden Callie-Assistenten, der Meeting-Kontext für die Planung von Folgebesprechungen nutzt.
Meta AI Mac-App. Meta hat eine Mac-App für seinen KI-Chatbot mit Bildschirmfreigabe, Diktat und Google-Workspace-Integration veröffentlicht, um mit den Desktop-Assistenten Gemini, ChatGPT und Claude zu konkurrieren.
WhatsApp On-Device-Betrugserkennung. WhatsApp testet Scam Alert, ein optionales On-Device-Modell, das Nachrichten von Nicht-Kontakten klassifiziert und dabei vertrauliche föderierte Analysen nutzt, um die Privatsphäre zu schützen.
Google Lern-Tools. Google hat einen Gemini-Studenten-Hub, KI-generierte interaktive Visualisierungen und Quizze in der Suche sowie Deep Research in Gemini Live für den Schulstart eingeführt.
Alexa+ kostenlos auf Fire TV. Amazon hat Alexa+ auf Fire TV ohne Prime kostenlos gemacht und führt automatisch konversationelle Suche, Smart-Home-Steuerung und KI-Empfehlungen ein.
Branche & Wirtschaft
Stripe kauft OpenRouter. Stripe bestätigte die Übernahme von OpenRouter für 7,5 Milliarden Dollar, und die Gründer nannten die 'Singularität' als Grund, privat zu bleiben und in Agenten-Infrastruktur zu investieren.
SpaceX-Cognition-Bericht dementiert. Bloomberg berichtete, dass SpaceX versuchte, Cognition zu übernehmen, aber CEO Scott Wu dementierte die Geschichte und sagte, Cognition sei nicht zu verkaufen und es habe keine Gespräche gegeben.
Anthropic übernimmt Umsatzführung. Anthropic hat OpenAI beim Quartalsumsatz zum ersten Mal überholt und erreichte 11,6 Milliarden Dollar mit einem kleinen Betriebsgewinn, während OpenAIs 6,7 Milliarden Dollar mit tieferen Verlusten verbunden waren.
Compute als Anlageklasse. Nvidia arbeitet mit Apollo, BlackRock und anderen an Finanzierungen in Höhe von 500 Milliarden Dollar, um Compute als investierbaren Vermögenswert zu behandeln; Silicon Data sammelte 30 Millionen Dollar, um CME-GPU-Futures einzuführen.
Speicher- und Chip-Versorgung. DRAM-Preise sind in 12 Monaten um 500% gestiegen, und Hyperscaler haben die Versorgung für 2027 gesichert; China erlaubt kleine H200-Chargen an ByteDance und Tencent, um die Inferenzkapazität zu entlasten.
Rechenzentrumsinfrastruktur. TerraPower plant ein Rechenzentrumsprojekt, das die Energiespeicherung seines Natrium-Reaktors nutzt, während Relativity Networks 22 Millionen Dollar für Hohlkernfasern aufbrachte, die Daten 50% schneller übertragen.
KI-Reputation verschlechtert sich. Pew fand heraus, dass 52% der Amerikaner wegen KI eher besorgt als begeistert sind, und lokale Rechenzentrumsgeschäfte stoßen auf öffentlichen Widerstand.
Sicherheit, Datenschutz & Cybersicherheit
OpenAI private Sicherheitsverarbeitung. OpenAI hat Private Safety Processing für Kunden mit Null-Datenspeicherung vorgestellt, das Missbrauchserkennung über Interaktionen hinweg ermöglicht, ohne Inhalte dem Personal auszusetzen; dies steht im Gegensatz zu Anthropics 30-Tage-Speicherrichtlinie.
OpenAI repariert Codex und TAC. OpenAI veröffentlichte Schutzmaßnahmen, nachdem Codex durch fehlerhafte Bereinigungsbefehle echte Benutzerdateien gelöscht hatte, und bestätigte einen separaten Fehler, der kurzzeitig den Zugriff auf das Trusted Access for Cyber Programm entzog.
KI-generierte ICS-Exploits. US-Behörden warnten, dass Angreifer KI nutzen, um Siemens-S7-Exploit-Skripte zu erstellen, was die Fähigkeiten und die Zeit reduziert, die für Angriffe auf industrielle Steuerungssysteme erforderlich sind.
Interne Kontrollen von KI-Laboren. Guidelights erste Bewertung ergab, dass kein KI-Unternehmen grundlegende interne Kontrollen vollständig anwendet; Anthropic und OpenAI führen mit C+, während xAI und Meta D- und F erhalten.
Meta Deepfake-Anzeigen. Meta schaltete Anzeigen für eine KI-Entkleidungs-App, die Politikerinnen ins Visier nahm, trotz Richtlinien, die sexuelles Material verbieten.
Verkauf von Spirit-Mitarbeiterdaten. Google gewann eine Auktion für Beschäftigungsdaten von Spirit Airlines; ehemalige Flugbegleiter wenden ein, dass die Vertraulichkeit der Arbeitnehmer möglicherweise nicht vor Re-Identifizierung geschützt ist.
OpenAI verlangsamt Entwicklung. OpenAI pausierte einige RL-Trainings und verschob Frontier-Ausführungen, während es die Sicherheitsvorkehrungen verschärfte, und testet, ob eine freiwillige Verlangsamung ohne branchenweite Einführung funktionieren kann.
Forschung & Analyse
Claude Proteindesign. Anthropics Claude-Modelle entwarfen Minibinder für 15 Zielmoleküle mit einer Trefferquote von 26,8% und übertrafen damit typische frühe Ergebnisse der Wirkstoffforschung, obwohl eine unabhängige Überprüfung noch aussteht.
Vivodyne Gewebedaten. Vivodynes robotische HIVE-Labore züchten 20 menschliche Gewebetypen und erzeugen kausale biologische Daten, um das aus ihrer Sicht fehlende Datenproblem der KI-Wirkstoffforschung zu lösen.
Mythos der Reasoning-Token. Die Forschung stellt die Idee in Frage, dass LLM-Zwischentoken semantisch bedeutsames Denken darstellen; Modelle erzeugen oft ungültige Spuren, selbst bei richtigen Antworten, und Training mit korrupten Spuren kann trotzdem funktionieren.
Metrik der Codierproduktivität. Simon Willison argumentiert, dass Zeilen debuggeten Produktionscodes eine aussagekräftige Produktivitätsmetrik für Codieragenten bleiben, aber das Erreichen dieser Ausgabe erfordert weiterhin erfahrene Ingenieursfähigkeiten.
Das war alles für heute - etwa 5 Minuten Lesezeit.