Agent- en modelreleases
Muse Gadgets. Meta heeft firmware en een SDK open source gemaakt voor doe-het-zelfhardware die aan zijn Muse-agent hangt, zoals E Ink-displays en HDMI-sticks. Ondersteuning loopt via een Discord.
OpenAI Dot. De nieuwe Dot-agent van OpenAI gedraagt zich als bedrijfssoftware die ook het avondeten kan bestellen. Hij draait in een virtuele machine met toegang tot apps als Blender en GIMP en wordt neergezet als collega, niet als persoonlijke shopper.
Humanoïde model van Unitree. Unitree heeft UnifoLM-WLA-1.0 uitgebracht, een model van 6B dat is getraind op zo'n 2.500 uur echte robotdata en op de G1 64 taken uitvoert, zowel hele-lichaamstaken als tafelopdrachten. Het combineert optical flow en MMDiT voor continue aansturing.
FrogNano voor code. FrogNano-4B-2609 van Microsoft is een agentisch model dat is afgeleid van Qwen3.5-4B. Het is nagetraind op 1.500 synthetische SWE-taken met uitvoerbare beloningen om software-engineering op repositoryniveau in compacte vorm te verbeteren.
Cloudflare Clef. Cloudflare heeft de beslismodellen Clef en Clef-flash uitgebracht. Die geven waarschijnlijkheden voor vooraf gedefinieerde antwoorden en halen een mediane latentie van 39 ms, zodat agenten kunnen handelen zonder mens in de loop.
Tools en frameworks
MegaCapybara-engine. Een speciaal voor de RTX 5090 en Qwen3.8 27B gebouwde inferentie-engine zegt naar eigen zeggen ongeveer twee keer zo snel te decoderen als NInfer: meer dan 500 t/s bij één run en meer dan 2000 t/s over 12 agenten, met dynamische kernels en cachebeheer.
llama.cpp-updates. llama.cpp heeft ondersteuning voor beslismodellen toegevoegd, plus een CUDA-pullrequest die gedeelde experts samenvoegt om MoE-architecturen zoals Qwen 35B A3B te versnellen.
mlsubgen-ondertitels. Een nieuwe lokale tool genereert ondertitels in 45 talen volledig op je eigen machine. Hij herkent de taal per fragment, stemt twee spraakherkenners op elkaar af met een lokaal LLM en verkiest bestaande ingebedde ondertitels.
Onderzoek en modelontwikkelingen
Geheugenarchitectuur Spotlight. Spotlight van Percepta vervangt attention door onbegrensd beschrijfbaar geheugen dat het model zelf indexeert. Zo scheidt het intelligentie van kennis, zodat vaardigheden kunnen groeien zonder dat de gewichten veranderen.
GPT-6-updates. OpenAI heeft een gids voor de GPT-6-familie gepubliceerd en DevDay-updates aangekondigd: GPT-6.1 Sol, computer use voor de Agents API, Codex-omgevingen in de cloud en een Decisions API.
AstaBrief open source. Hugging Face heeft AstaBrief open source gezet: een klein model dat speciaal is getraind om snel wetenschappelijke rapporten met bronverwijzingen te genereren, en dat dicht bij het bewijs blijft en zijn uitvoer verifieert.
Industrie en bedrijfsleven
Apple scherpt schijftoegang aan. Apple voegt controles toe aan Full Disk Access in macOS vanwege de risico's van AI-agenten, nadat Meta Muse naar verluidt zonder toestemming berichten zou hebben gelezen. Meta zegt dat toegang opt-in is; Apple wil een heel expliciete actie van de gebruiker.
Verzet tegen datacenters. Amazon heeft 1 miljard dollar toegezegd aan gemeenschappen rond datacenters, en AWS-ceo Matt Garman dringt aan op een einde aan de moratoria en noemt het verzet buitenlandse desinformatie. Microsoft breidt biomimicry bij datacenters verder uit ondanks lokaal verzet.
AI heet nu superintelligentie. Het Witte Huis kreeg grote tech-ceo's zover een AI-veiligheidsbelofte te ondertekenen en Trump ondertekende een presidentieel decreet dat AI omdoopt tot 'superintelligentie'. Tegelijk koopt slechts 2% van de consumenten AI-producten.
Opschudding bij OpenAI. OpenAI heeft drie onderzoekers ontslagen en een vierde vertrok, nadat een onderzoek uitwees dat ze vertrouwelijke informatie hadden gelekt naar een externe AI-veiligheidsorganisatie.
Uber Eats versnelt zoeken. Uber heeft zijn zoekpijplijn herbouwd en de end-to-endlatentie met 50% teruggebracht, waarbij agentic coding werd gebruikt om optimalisaties op te sporen en te valideren.
Inside-out-AI bij Airbnb. Airbnb-cto Ahmad Al-Dahle hanteert een inside-out-AI-strategie: zet generatieve AI eerst intern in om de productontwikkeling te versnellen en transformeer daarna de klantervaring.
Lokale AI en hardware
Strata met Qwen3.8 Next. Gebruikers melden dat Strata met Qwen3.8 Next 45-70 t/s haalt op een machine met traag DDR4-geheugen en een 7900XTX, en 150-200 t/s op een stroombegrensde RTX 5090 met 96 GB DDR5, aanzienlijk sneller dan llama.cpp.
iPhone als tweede GPU. Een iPhone 17 Pro Max kan de prefill van Qwen 3.8 27B met 29-44% versnellen op een MacBook met 24 GB, mits hij via USB-C is aangesloten en de bovenste lagen op de GPU van de telefoon draaien.
Ascend-kaarten van 96 GB. Twee Huawei Atlas 300I Duo-kaarten van elk 96 GB halen met Qwen3.8 Flash-Next zo'n 30 t/s na het afstellen van de softwarestack, ook al zijn het geen drop-in vervangers voor CUDA.
Kosten DGX Spark en 5090. Nvidia bracht een DGX Spark van 64 GB uit, terwijl de prijs van het oorspronkelijke model met 128 GB steeg naar 6.950 dollar. Wie bij Micro Center een RTX 5090 koopt, moet naar verluidt nu exportpapieren invullen.
Dat was het voor vandaag - ongeveer 5 minuten leestijd.