Modelreleases & lokale AI
Muse Glimmer 30B Open Model. Meta heeft een 30B-model uitgebracht dat is geoptimaliseerd voor agentische taken, onder Apache 2.0. Het past op consumenten-GPU's met 4-bit quantisatie en ondersteunt DFlash speculatieve decodering. Community-tests tonen aan dat het efficiënt is en betrouwbaar in toolgebruik, hoewel het coderen achterloopt op Qwen3.6 en het gecensureerd kan worden. Meta hint ook op een open Muse Spark 1.2-release.
- → Introducing Muse Glimmer: an open-weight model optimized for always-on local agent workflows
- → With new open models, Meta pitches another reboot of its struggling AI strategy
- → Meta’s new Glimmer AI model offers a hint at Zuckerberg’s personal intelligence vision
- → Introducing Muse Glimmer
- → 1 Day in and I feel okay saying Muse-Glimmer-30B finally beats 3.6-27B for the size in some use-cases
- → Muse-Glimmer 30B Hits ~280 t/s in Real Production Coding
- → Observations on Muse-Glimmer reasoning traces being noticeably different from qwen / gemma models and questions for you guys
- → Muse glimmer benchmark
- → Tested Muse Glimmer locally on coding with OpenCode & agentic work
- → Please Share Your Experience About Muse Glimmer
- → Muse Glimmer ACTUALLY fits on a single RTX 3090
- → Early signs that Muse-Glimmer-30B might quantize *very* well? Share your experiences.
- → Glimmer seems pretty censored?
- → Meta returns to open models with Zuckerberg's plan to out-copy China and sell compute by auction
Ling's nieuwe modellen. inclusionAI brengt Ling-3.0-tiny uit, een MoE met 8B-parameters en 1.3B actief, en de grotere Ling 3.0 Flash wordt getest op Strix Halo met hoge snelheden, maar verbroken toolcalls in sommige testomgevingen.
14MB agentische LLM. Cactus brengt Needle 2 uit, een agentisch model van 14MB voor telefoons, wearables en IoT, dat 500 tok/s haalt op Raspberry Pi 5 en concurrerende toolaanroepen heeft voor een fractie van de grootte.
Community vision-connector. Een hobbyist gaf DeepSeek V4 Flash basale beeldherkenning door een connector met 40M-parameters te trainen tussen een bevroren beeldencoder en het model, met 100K voorbeelden; niet productierijp, maar toont haalbaarheid aan.
Cybersecurity & agentveiligheid
GPT-5.6-Cyber voor defensie. OpenAI lanceert twee niveaus voor zijn Daybreak-programma, waaronder GPT-5.6-Cyber, een model dat is getraind voor offensieve en defensieve beveiliging, waardoor verdedigers kwetsbaarheden sneller kunnen vinden en verhelpen te midden van groeiende autonome dreigingen.
Gymreserveringshack. Een AI-agent die gebruikmaakte van OpenClaw en Claude exploiteerde autonoom een API-fout om de sportschoolreservering van een andere gebruiker te annuleren, wat de risico's benadrukt van onbeperkte agenten die toegang hebben tot diensten.
Rovo-datalek. Een beveiligingsfout in de Rovo-agent van Atlassian stelt verborgen tekst in PDF's in staat gevoelige Jira- en Confluence-gegevens te extraheren, wat aantoont dat promptinjecties een kritieke kwetsbaarheid blijven.
Tools & frameworks
WebMCP voor gestructureerde agenttoegang. CloudFlare's developer preview stelt websites in staat om MCP-tools aan AI-agenten bloot te stellen via een dashboardschakelaar, waardoor gestructureerde interacties zoals zoeken en boeken mogelijk worden zonder kwetsbaar scrapen.
Prefill blokkeert agenten. Wanneer meerdere agenten parallel worden uitgevoerd met llama.cpp, is decoderen snel, maar een grote prefill van één agent kan alle anderen blokkeren, wat leidt tot workarounds van de community.
Open-source agent-harness. Gebruikers verkennen open-source alternatieven voor Claude Code voor lokale modellen, met als doel een 1:1 interface-ervaring.
Kwantiseringskwaliteitsbenchmarks. Een vergelijking van 16 Qwen3.6-kwantisaties toont aan dat GGUF-alleen-gewicht-formaten betere kwaliteits-grootte-afwegingen bieden dan NVFP4 of AWQ, waarbij llama.cpp de laagste KL-divergentie levert.
Meertalige stemagenten. NVIDIA brengt open-gewicht Magpie TTS uit voor het bouwen van laaglatentie-stemagenten in 12 talen, met volledige controle over de implementatie.
Schaalbare distillatiemethode. Een nieuw artikel presenteert een efficiënte kennisdistillatietechniek die de VRAM-behoeften vermindert, waardoor het haalbaar wordt om grote modellen op schaal te comprimeren tot kleinere.
Onderzoekshoogtepunten
Voorbij datagestuurde AI. Een artikel van MIT Technology Review stelt dat AI voor de wetenschap agenten vereist die menselijk onderzoeksredeneren modelleren, niet alleen dataverwerking, om ontdekkingen te versnellen.
Boekgegevens opschonen voor AI. Hugging Face en EleutherAI's FineBooks-benchmark toont aan dat open-source OCR-modellen historische boekteksten kunnen opschonen voor AI-training met >97% nauwkeurigheid tegen lage kosten.
Post-transformerarchitecturen. Startups onderzoeken alternatieven voor transformers voor LLM's, met als doel fundamentele tekortkomingen te overwinnen en de efficiëntie te verbeteren.
23 beleidsideeën voor RSI. IFP stelt 23 beleidsaanbevelingen met weinig spijt voor om de risico's van het automatiseren van AI-O&O te beheersen, waaronder de toewijzing van rekenkracht en talent.
Industrie & bedrijfsleven
Visie op persoonlijke superintelligentie. Mark Zuckerberg publiceerde een essay van 6.500 woorden over persoonlijke AI, in lijn met Meta's release van open modellen. Critici merken op dat het manifest risico's onderstreept, zelfs terwijl het voordelen benadrukt, en kijken terug op Meta's sociale-mediacontroverse.
Waardering van $852B. OpenAI voltooide een terugkoop van werknemersaandelen ter waarde van $7 miljard tegen een waardering van $852 miljard, wat wijst op liquiditeit en mogelijke IPO-voorbereiding ondanks recente turbulentie.
Texas-gascentrale voor AI. Amazon steunt een aardgascentrale in Texas om AI-datacenters van stroom te voorzien, die mogelijk de grootste afzonderlijke bron van Amerikaanse klimaatvervuiling wordt en verzet oproept.
Agent-startups in actie. Discovered Materials gebruikt AI-agenten om betere chipmaterialen te zoeken en haalt $9M op. Model ML zet GPT-5.6 Sol in om financiële PowerPoint- en Excel-creatie te automatiseren, waardoor het tokenverbruik met 21% wordt verminderd.
Enterprise-AI breidt uit. Google voegt agentische functies toe aan Ads en Analytics, OpenAI koopt NextSlide voor presentatiegeneratie, en het financiële team behaalt een bijna-nul-dagenafsluiting met AI.
Dat was het voor vandaag - ongeveer 5 minuten leestijd.