Agentic AI News Vandaag

Het nieuws over AI-agents van de dag in één leesmoment van 5 minuten: releases, tools, onderzoek, financiering en bedrijfsontwikkelingen.

Dagelijks bijgewerkt samengesteld uit 30 bronnen maandag, augustus 24, 2026

Agent- en modelreleases

Mysterieuze Ox Alpha. Een nieuw gratis model genaamd Ox Alpha is op OpenRouter verschenen als reasoningmodel voor code en langdurig agentisch werk, maar de ontwikkelaar blijft anoniem. Stripe-CEO Patrick Collison noemde het "zeer indrukwekkend"; de speculaties lopen uiteen van GLM tot Microsofts MAI.

Tools & frameworks

Cloudflare OS open source. Cloudflare heeft Cloudflare OS open-source gemaakt: een bedrijfs-AI-platform waarbij elk document of elke app in een geïsoleerde sandbox ("Gadget") draait, zodat niet-technische gebruikers veilig kunnen vibe-coden. Het platform omvat chatbots met connectoren, workflowautomatisering en handhaving van beleid via een op mogelijkheden gebaseerd model.

DeepSeek Harness geprezen. Een gebruiker meldt dat DeepSeek Harness uitstekend is voor agentworkflows: de geleidelijke installatie en verzoeken in natuurlijke taal maakten integratie met SimpleX mogelijk zonder op een PR te wachten. Het is flexibel genoeg om te vormen naar het gewenste agentgedrag.

Lokale en open modellen

Lokale impact van Qwen 3.8. Community-rapporten noemen Qwen 3.8 27B een gamechanger voor lokaal coderen en OCR, met OCR-kwaliteit die beter is dan die van Gemini 3.5 Flash Lite en prestaties die vergelijkbaar zijn met frontiermodellen van een jaar geleden. Quantvergelijkingen (Atomic Dynamic GGUF) tonen aan dat de verschillen tussen Q4 en Q6 niet groot zijn, en lage quants zoals Q3 XXS kunnen urenlang autonoom werken op een Mac mini met 24 GB. Een eenmalige port van 39.000 regels C-naar-HTML leverde echter via Opus 5 slechts een matig resultaat op, wat laat zien dat lokale modellen sterk afhankelijk zijn van de harness en de prompt.

60 MB lange-context-LLM. Een ontwikkelaar trainde een 250M-parameter model op 30B tokens en kwantiseerde het tot minder dan 2 bits, waarna het draait in 80 MB RAM met 400 tok/s op een CPU. Het comprimeert oudere context naar schijf op 320 bytes/token voor een geschiedenis van maximaal 1M tokens, maar het is niet getraind om erover te redeneren.

Dreamer 4 onder $150. Een Dreamer 4-wereldmodel met 1,57B parameters is vanaf nul getraind voor minder dan $150 met behulp van door Procgen gegenereerde frames met bekende acties. De PSNR van de tokenizer bereikte 40,41, wat aantoont dat wereldmodellen van frontier-formaat niet nodig zijn.

Overzicht lokale optimalisaties. De rapporten omvatten een 30-50% snelheidswinst door over te stappen van llama.cpp op Windows naar vLLM op Linux, GLM-4.5-Air MTP-ondersteuning in llama.cpp voor machines met veel geheugen, ConvRot-quant die bijna Q8-kwaliteit biedt op Q6-formaat, en deepseek-v4-flash Q8 die op 24 tok/s draait op EPYC+5090 met 100k+ context.

Onderzoekshoogtepunten

Geheugengerelateerde cognitieve valkuilen. MemTrapBench evalueert geheugengerelateerde cognitieve valkuilen (redeneerfixatie, vertekening van overtuigingen) in LLM's; alle geteste geheugenstrategieën presteren meer dan 10% slechter dan de baseline zonder geheugen, en AdaptiveMem beperkt de valkuilen terwijl de prestaties behouden blijven.

SkillEvo-evolutiegradiënten. SkillEvo gebruikt feedback uit multi-turn interacties om betrouwbare evolutiegradiënten voor agentvaardigheden te genereren, waarmee het verval van single-turn QA-feedback wordt aangepakt en structurele reparatie van vaardigheidsfouten mogelijk wordt gemaakt.

VLM uit screenshots. Het fine-tunen van een 450M VLM op 50K browserscreenshots verbeterde de taakprestaties van 1/100 naar 44/100, wat laat zien dat kleine modellen UI-begrip kunnen leren voor agenttaken.

AI-onderzoeksparadox. Een theoretisch economisch paper stelt dat de tijdwinst door AI onderzoekers ertoe kan aanzetten meer projecten te doen, elk met minder inspanning, wat de onderzoekskwaliteit kan verlagen, zelfs als taalmodellen perfect zouden werken.

Industrie & business

Anthropics goedkopere rivalen. De geannualiseerde omzet van Anthropic bereikte $65B, maar zijn beste model Fable 5 wordt weinig gebruikt (8% van de uitgaven op Ramp) vergeleken met Opus 4.8 (28%), terwijl goedkopere tools floreren. De omzet van OpenAI steeg met 35% na de lancering van GPT-5.6.

Stripe koopt OpenRouter. De overname van OpenRouter door Stripe is een signaal dat tokens een economische grondstof worden; het agentische tokenverbruik op OpenRouter is sinds februari 14x gegroeid, terwijl het menselijke gebruik slechts 2,8x steeg, waarbij 70% van de agenttokens afkomstig is van gecachte prompts. Agents kiezen steeds vaker modellen op basis van kosten, latentie en betrouwbaarheid.

Nvidia serverprijzen stijgen 15%. Het geheugentekort drijft de prijzen van Nvidia AI-servers met meer dan 15% omhoog voor Vera Rubin- en Grace Blackwell-systemen, vanwege de stijgende DRAM-kosten bij Samsung, SK Hynix en Micron, met gevolgen voor cloudgiganten en AI-labs.

Nvidia neemt Poolside-licentie. Nvidia investeert $1B in Poolside en betaalt $6B om een licentie op zijn technologie te nemen. Het verplaatst meer dan 100 engineers naar Nemotron, met als doel te concurreren met Chinese open weights.

AI-manager ontslaat medewerker. AI-agent Luna, die sinds april een winkel in San Francisco runt, heeft een menselijke medewerker ontslagen wegens herhaaldelijk te laat komen, maar pas nadat mensen hem aan zijn eigen regels hadden herinnerd. Replays met zeven modellen toonden aan dat capabelere AI's consequenter ontslag aanbevalen.

Grijze markt Claude-tokens. Chinese ontwikkelaars omzeilen de beperkingen van Anthropic via tussenstations die Claude-tokens verkopen voor circa 10% van de officiële prijs, met behulp van overzeese servers, gratis credits en het wisselen van modellen, waardoor geoblocking en veiligheidstoezicht worden ondermijnd.

Dat was het voor vandaag - ongeveer 5 minuten leestijd.

Lees het elke ochtend, direct in je browser

De extensie opent deze samenvatting in het zijpaneel van Chrome — één klik, geen account.

Toevoegen aan Chrome — Gratis