Agentic AI News Vandaag

Het nieuws over AI-agents van de dag in één leesmoment van 5 minuten: releases, tools, onderzoek, financiering en bedrijfsontwikkelingen.

Dagelijks bijgewerkt samengesteld uit 30 bronnen donderdag, oktober 8, 2026

Modellen & interfaces

Claude Haiku 5.5. Het nieuwe snelle en goedkope model van Anthropic biedt een context van 1 miljoen tokens en verlaagt de promptprijs naar $0,10 per miljoen tokens voor de eerste 100K tokens, net als bij GPT-6 Luna. De tokenizer telt echter ongeveer 25-30% meer tokens en boven 100K worden de prijzen vijf keer zo hoog. Benchmarks laten een grote sprong zien ten opzichte van Haiku 4.5 en competitieve agentic coding.

Mistral Large 4 'Le Chonk'. Mistral heeft een open-weight model met 1 biljoen parameters in preview uitgebracht, geoptimaliseerd voor coding, cyberdefensie en specifieke sectoren. Het bedrijf claimt dat het model qua capaciteiten dicht bij frontier-modellen uit de VS en China komt.

Liquid AI-decisionmodellen. Liquid AI heeft d1-3B en d1-omni-600M open source uitgebracht. Dit zijn multimodale decisionmodellen die gecalibreerde antwoorden geven in de vorm van ja/nee, een keuze of een score, zonder outputtokens. d1-3B claimt best-in-class te zijn onder 10B op de Decision Index en draait in slechts 16 ms op NVIDIA Jetson-hardware; er verschijnt ook een WebGPU-browserpoort.

OpenAI Decisions API. OpenAI heeft een bèta van de Decisions API gelanceerd voor ja/nee-, categorische en schaalevaluaties op tekst of afbeeldingen, ongeveer 10x sneller dan Responses. De API ondersteunt GPT-6 Luna voor $0,10 per miljoen inputtokens, met gratis outputtokens.

ChatGPT Intelligent UI. Met GPT-6 kan ChatGPT interactieve grafieken, knoppen, formulieren en mini-apps tonen in plaats van platte tekst. Volgens OpenAI begint het redeneren al tijdens het denken om wachttijden te verkorten. Betalende gebruikers krijgen GPT-6 Sol, gratis gebruikers krijgen Luna.

Kandinsky 6.0-videogeneratie. Kandinsky Lab heeft Kandinsky 6.0 Pro (29B) en Lite (3B) uitgebracht met ondersteuning voor ComfyUI en Diffusers; ook nieuw is een video-upscaler.

Nemotron-competitieresultaten. Fine-tuned Nemotron-modellen behaalden een onofficieel resultaat op goudniveau op IOI 2026 (535,4/600) en een officiële gouden score van 30/42 op IMO 2026, met SFT, RL en generate-verify-refine.

Agents & frameworks

Nous Research-agents. Nous Research heeft $90 miljoen opgehaald bij een waardering van $1,5 miljard en Hermes for Businesses gelanceerd, dat zich richt op AI-agents voor bedrijven. De open-source Hermes Agent is 24 miljoen keer gekloond en is goed voor naar schatting 2,5% van het wereldwijde AI-tokenverbruik.

LangChain Deep Agents. LangChain introduceerde Skills-updates die tools aan skills koppelen om de context klein te houden, en Managed Deep Agents v0.9 met door agents gemaakte planningen, configuratie per run en Slack-reacties.

Microsoft Copilot-acties. Met Microsofts Hybrid Intelligence krijgt Copilot toegang tot lokale bestanden en kan de assistent acties uitvoeren in Windows, zoals het vinden, hernoemen, zippen en e-mailen van documenten voor een gebruiker.

Meta Muse op iPad. Meta's agent-assistent Muse heeft nu native iPad-ondersteuning, na 6,6 miljoen installaties, en voegt connectors toe voor tools als Canva, GitHub en QuickBooks.

Agent Lightning RL. Microsoft Research heeft Agent Lightning v1.0 open source uitgebracht, een agentic RL-framework van 3.500 regels dat echte deployment-harnesses en native Kubernetes gebruikt. In een voorbeeld verhoogde het de Pass@1 van Qwen3.5-9B op SWE-bench Verified van 41,8% naar 56,4% met ongeveer 6.000 trainingssamples.

Lokale AI & ontwikkelaarstools

ROCm 10.1. ROCm 10.1 van AMD richt zich op de bottleneck bij databeweging in lokale inferentie; lokale AI-gebruikers bespreken de release op Reddit.

llama.cpp MoE-versnellingen. llama.cpp kreeg een GPU-cache voor MoE-experts die in het hostgeheugen blijven, wat grote versnellingen belooft voor modellen die niet volledig in VRAM passen. Ook is er ondersteuning voor GLM5Next MTP toegevoegd.

Unsloth Studio controleert repo's. Unsloth Studio controleert vertrouwde modelrepositories nu opnieuw voordat ze worden uitgevoerd, nadat gecompromitteerde LiteLLM-versies op PyPI lieten zien hoe supply-chainaanvallen AI-tooling kunnen bereiken.

GLM-5.3-Flash dual-GPU. Een setup met twee CMP 170HX-kaarten van 64 GB draait GLM-5.3-Flash met een context van 384K en ongeveer 90 tokens/s via EXL3. De 320B MoE houdt actieve gewichten in HBM en wordt gebenchmarkt tegen Qwen3.8-Flash-Next.

Lokale Qwen-benchmarks. Recente evaluaties uit de community vergelijken Qwen3.8-27B-finetunes en Qwen3.8-Flash-Next met frontier-modellen op domeinspecifieke en codingtaken. Een evaluatie met 469 vragen vond dat lokale modellen frontier-output kunnen benaderen met behoud van privacy en tegen lagere kosten, al blijft overmatig gebruik van thinking-tokens een probleem.

Hardware & Windows

Surface AI-hardware. Microsoft heeft de Surface Laptop Ultra en de Surface RTX Spark Dev Box aangekondigd, beide op de Arm-gebaseerde RTX Spark-chip van Nvidia. De laptop begint bij $2.599 en biedt tot 128 GB unified memory; de verzending start op 16 oktober. De Dev Box begint bij $5.999 en is bedoeld voor lokale modellen van 120B+.

Industrie & business

AI-kloof in codebegrip. Een enquête onder 300 senior engineeringleiders vond dat AI-codingagents de bottleneck hebben verplaatst naar debuggen en codebegrip: teams besteden nu 9,8 uur per week aan het schrijven van code, maar 16,9 uur per week aan debuggen. Het rapport wijst op een groeiend risico in mission-critical codebases.

Initiatief voor virtuele cel. Biohub coördineert een initiatief van $1,8 miljard om AI-modellen te bouwen die celgedrag voorspellen. Google DeepMind, Meta en Isomorphic Labs investeren $300 miljoen, en het Amerikaanse DOE legt meer dan $500 miljoen in voor labmetingen en compute.

Open-sourcekloons van Adobe. Ontwikkelaar Brandon Thomas gebruikte Claude Opus 5.5 om Artcraft te bouwen, een suite van zeven open-source Rust/WebAssembly-apps die Adobe's Photoshop, Illustrator, Premiere en andere Adobe-apps namaken. De apps zijn nog vroeg in ontwikkeling en hebben nog veel tekortkomingen, maar het project laat zien hoe AI kan helpen bij clean-roomherimplementatie.

SynthID-detector voor iedereen. Google heeft zijn SynthID-detector opengesteld voor het publiek, zodat iedereen afbeeldingen, video's en audio kan controleren op watermerken van Google of partners. Het systeem heeft al meer dan 180 miljard media-items gemarkeerd en is ook ingebouwd in Chrome en Gemini.

Google Playground-games. Google Labs heeft Playground gelanceerd, een platform in de browser waar Amerikaanse volwassenen games kunnen maken op basis van tekstprompts, met Gemini, Nano Banana en Lyria. Unity kondigde daarnaast Unity Spark aan voor professionele AI-ondersteunde gameontwikkeling.

Dat was het voor vandaag - ongeveer 5 minuten leestijd.

Lees het elke ochtend, direct in je browser

De extensie opent deze samenvatting in het zijpaneel van Chrome — één klik, geen account.

Toevoegen aan Chrome — Gratis