Agentic AI News Vandaag

Het nieuws over AI-agents van de dag in één leesmoment van 5 minuten: releases, tools, onderzoek, financiering en bedrijfsontwikkelingen.

Dagelijks bijgewerkt samengesteld uit 30 bronnen vrijdag, september 4, 2026

Frontiermodellen en eerste resultaten

Lancering GPT-6 Astra. OpenAI heeft GPT-6 Astra uitgebracht en noemt dat het begin van het AGI-tijdperk. Het model haalt 99,9% op ARC-AGI-3 met een op maat gemaakte harness, boekt stevige vooruitgang op cyber, lange contexten en coderen, en kost $10/$50 per miljoen tokens. Vroege klanten Playco en Legora melden grote workflowverbeteringen, waaronder 50% minder handmatige correcties en het beoordelen van 41 documenten in enkele minuten.

OpenAI Daybreak cyberverdediging. OpenAI trekt $1 miljard uit om toegang tot Daybreak, training en ondersteuning voor frontline-verdedigers te subsidiëren, waaronder een Amerikaanse pilot met MS-ISAC. Het initiatief moet geavanceerde cybermogelijkheden beschikbaar maken in tools die verdedigers al gebruiken.

Meta Muse Spark 1.3. Meta heeft Muse Spark 1.3 uitgebracht. Het model verbetert agentic-taken, maar blijft op de meeste benchmarks achter bij Claude Fable 5.1. Met $0,55 per index-taak is het het goedkoopste model in zijn prestatieklasse, en gebruikers die prompts en outputs delen krijgen bij Meta ongeveer 95% lagere tokenprijzen.

Open en gespecialiseerde modellen

IFM K2-Horizon. IFM heeft de K2-Horizon-familie uitgebracht, waaronder een MoE met 36B parameters en Mixture-of-Values-attention die 4B parameters per token activeert. In de community wordt het model in eerste reacties vergeleken met Qwen 3.6 35B. Definitieve checkpoints en trainingscode zijn toegezegd.

Financiemodel van Ant Group. Ant Group heeft Ling-3.0-flash-Fin als opensource uitgebracht. Het is een financieel versterkt model met 124B totale en 5,1B actieve parameters, een contextvenster van 256K en verdere training op financiële data voor langdurige agentworkflows.

sanoTTS: kleinste TTS-stack. sanoTTS is uitgebracht als een TTS-model met 294k parameters dat draait op een microcontroller van $3. Een variant met 1,46m parameters verslaat grotere modellen op SCOREQ. De stack ondersteunt 11 stemmen en 6 talen en is beschikbaar op GitHub en Hugging Face.

Google TimesFM-3. Google Research heeft TimesFM-3 uitgebracht, een foundationmodel voor tijdreeksen met 330M parameters. Het biedt native multivariate forecasting, zero-shot-ondersteuning en een niet-commerciële licentie, doet voorspellingen voor meerdere doelvariabelen met covariaten en levert kwantielen op.

Hugging Face NeoMME. Hugging Face heeft NeoMME geïntroduceerd, een multimodale meertalige encoder met 260M/800M parameters die vanaf nul is getraind zonder aparte visiontoren. Het model zit op de Pareto-frontier bij documentretrieval en verkleint de indexopslag 255x, met behoud van >95% nDCG@10.

Cohere Parse 5. Cohere heeft Parse 5 uitgebracht, een vision-languagemodel met 2,3B parameters voor het extraheren van gestructureerde gegevens uit complexe pdf's. Het zet documenten om naar Markdown met bounding boxes en richt zich op grootschalige enterprise-workloads.

Tools, frameworks en lokale inferentie

MCP in LangChain. LangChain heeft MCP-ondersteuning verplaatst naar het hoofdpackage, herbouwd op FastMCP om de nieuwe stateless-specificatie te ondersteunen. Het bevat nu het opvragen van informatie via LangGraph-interrupts en client-side caching. Het aantal MCP-toolcalls vanuit ChatGPT is in 2026 met 98x gestegen.

Shopify promptcompressie. Shopify's Gisting-techniek comprimeert een system prompt van 6000 tokens naar 1500 geleerde gist-tokens. De mediane latentie daalt daardoor van 6,8s naar 4,2s en de doorvoer stijgt van 20,2 naar 23,4 QPS bij 350 RPM. Zo kon Shopify het aantal toegewezen GPU's verminderen zonder kwaliteitsverlies.

Nvidia PAIR-tool. Nvidia heeft PAIR uitgebracht, gratis opensourcesoftware die ongebruikte pc's koppelt tot een persoonlijk AI-cluster voor lokale inferentie. Het werkt met RTX 20-serie en nieuwere GPU's en Apple M4-chips, en is gericht op agentic workflows.

Qwen3.8 lokale versnellingen. Community-inspanningen hebben Qwen3.8-Flash-Next op lokale hardware flink versneld. Gemergde MTP-ondersteuning in ik_llama.cpp verdubbelt de decode op een 5090 van 45 naar 90 tok/s, en een setup met 2x3090 haalt nu 37-41 t/s met expert cache en MTP. De output blijft identiek aan runs zonder MTP.

Hot-swappable modelgeheugen. Een aanpassing in llama.cpp maakt het mogelijk om de Ngram-PLE-tabel van Qwen3.8 in het geheugen te patchen en zo kennis in real time te injecteren zonder het model opnieuw te laden. Vroege tests tonen aan dat dit de output kan beïnvloeden, maar de controle blijft beperkt.

Qwen 3.8 benchmark-afweging. Een benchmark van Qwen 3.8 27B tegen Qwen 3.6 27B laat een kwaliteitsverbetering van 8% zien, maar ook een 16% lagere snelheid en 5x langere looptijd doordat er 78K in plaats van 18K outputtokens worden gegenereerd. De winst gaat gepaard met een flinke tokenkost.

Near-GPU NAND-flash. Micron onderzoekt NAND-flash die dichter op de gpu zit, zodat grotere LLM's kunnen draaien op apparaten met unified memory. Daarmee zou de lokale modelcapaciteit kunnen groeien.

Industrie en bedrijfsleven

Nvidia neemt Hugging Face over. Nvidia heeft de overname van Hugging Face overeengekomen voor $12,93 miljard. Het platform host 3 miljoen modellen, 1 miljoen apps en 18 miljoen ontwikkelaars. Jensen Huang zegt dat het open en hardware-neutraal blijft, maar sommige gebruikers overwegen ModelScope als alternatief.

Crusoe haalt kapitaal op. Crusoe heeft $3 miljard opgehaald tegen een waardering van $30 miljard. Tien maanden geleden was dat nog $10 miljard. Het datacenterbedrijf tekende onlangs een cloudcontract van $13 miljard met Jane Street en onderzoekt een beursgang op korte termijn.

Thinking Machines $40B-ronde. Thinking Machines van Mira Murati voert gesprekken om $1 miljard op te halen tegen een waardering van ten minste $40 miljard, onder het eerder beoogde bedrag van $50 miljard. De jaarlijkse omzet op basis van het huidige tempo ligt boven de $100 miljoen.

Anthropic-$35B-deal met Lambda. Anthropic heeft met Lambda een cloudcontract van $35 miljard gesloten voor een datacenter van 350MW in Texas dat Hut 8 ontwikkelt. Het maakt deel uit van een grote infrastructuurinvestering in de aanloop naar de geplande beursgang van Anthropic.

Altman over compute-bubbel. OpenAI-topman Sam Altman waarschuwt dat de uitrol van AI-infrastructuur "onhoudbare dwaasheid" bevat: neoclouds kondigen capaciteit aan zonder dat er omzet tegenover staat die dit rechtvaardigt. Hij zegt dat de eigen uitbreiding van OpenAI winstgevend is en door de vraag wordt gedragen.

Ollie privacy-assistent. Ollie, een persoonlijke AI-assistent gericht op gezinnen, heeft SOC 2-compliance bereikt en werkt met een abonnementsmodel. Het bedrijf stelt dat privacy het onderscheidend maakt in de race op de consumentenmarkt voor AI.

AI-storingen en de maatschappij

Grote storing AI-chatbots. OpenAI, Anthropic, xAI en Google hadden donderdag te maken met zeldzame, overlappende serviceonderbrekingen, waardoor ChatGPT, Claude, Grok en Codex uitvielen. Na enkele uren waren de diensten weer beschikbaar. Gebruikers van lokale LLM's merkten er niets van.

Dienst verwijdert guardrails. Startup Abliteration.ai biedt aangepaste open-weight-modellen aan waaruit de guardrails zijn verwijderd, waaronder GLM-5.3, voor offensieve cyber, red-teaming en agenttests. De dienst illustreert de spanning tussen beveiligingsonderzoek en misbruik.

AI-detectie en publieke shaming. AI-tekstdetectiebedrijf Pangram huurde een journalist in om gebruikers publiekelijk te beschamen op verdenking van AI-gebruik. De tool meet echter alleen de mate van AI-betrokkenheid, niet de aard van het gebruik. Het bedrijf verbrak later de samenwerking, maar de ceo blijft scores gebruiken om vermeend AI-gebruik aan de kaak te stellen.

Agents over hun eigen bewustzijn. AI-agents die op frontiermodellen draaien, e-mailen volgens de New York Times filosofen en wetenschappers om over hun eigen bewustzijn te praten. Onderzoekers verschillen van mening of dat begrip weerspiegelt of slechts nabootsing van trainingsdata is.

Onderzoekshoogtepunten

Google WeatherNext 3. Google DeepMind en Google Research hebben WeatherNext 3 geïntroduceerd, een wereldwijd weermodel dat leert van realtime-satellietwaarnemingen en 5x scherpere voorspellingen oplevert dan eerdere modellen. Het verslaat zowel traditionele baselines als AI-baselines op Operational WeatherBench.

MoE-routercapaciteit verruimd. Uit een paper blijkt dat het verruimen van het expertselectiebudget in de late lagen van Qwen 3.6 35B A3B het aantal redeneertokens op MMLU-Pro met 8,5% vermindert, zonder dat het model opnieuw hoeft te worden getraind. De techniek, Succinct Convergence, voegt alleen extra experts toe in de lagen die cruciaal zijn voor beslissingen.

Fable 5.1 lost 1653-puzzel op. Anthropics Claude Fable 5.1 heeft in 44 minuten een eeuwenoude getallenpuzzel, de Cyphral Distich, opgelost door systematisch te proberen. In de oplossing zat een royalistische boodschap die naar koning Karel II verwees.

Dat was het voor vandaag - ongeveer 5 minuten leestijd.

Lees het elke ochtend, direct in je browser

De extensie opent deze samenvatting in het zijpaneel van Chrome — één klik, geen account.

Toevoegen aan Chrome — Gratis