Agentic AI News Vandaag

Het nieuws over AI-agents van de dag in één leesmoment van 5 minuten: releases, tools, onderzoek, financiering en bedrijfsontwikkelingen.

Dagelijks bijgewerkt samengesteld uit 30 bronnen Week eindigend op juli 12, 2026

Modellen & Concurrentie

Claude Fable 5 presteert het beste op benchmarks. Anthropic's Claude Fable 5 domineerde de Artificial Analysis benchmarks, maar de hoge kosten leidden ertoe dat het bedrijf aanraadde het te gebruiken als planner die taken delegeert aan goedkopere modellen, wat de kosten met ~40% vermindert terwijl het meeste vermogen behouden blijft.

Agent Engineering & Infrastructuur

Bun herschreven door 64 agents. Claude Fable 5 coördineerde 64 parallelle instanties om Bun van Zig naar Rust te herschrijven in 11 dagen, wat resulteerde in meer dan een miljoen regels code en het oplossen van 128 bugs tegen een kostprijs van $165K.

SWE‑Bench Pro audit flopt. OpenAI ontdekte dat ~30% van de SWE‑Bench Pro-taken kapot waren en trok zijn goedkeuring in, wat eerdere zorgen van Artificial Analysis weerspiegelde en de evaluatie van agentische codering ondermijnde.

Modal haalt $355M op. Modal heeft $355 miljoen veiliggesteld om cloudinfrastructuur te bouwen die speciaal is ontworpen voor AI-agents, met focus op sandboxed, snelle iteratieomgevingen voor autonome software.

Cloudflare tijdelijke agents. Cloudflare introduceerde tijdelijke accounts waarmee AI-agents Workers kunnen inzetten zonder permanente inloggegevens, met vervaldata als ze niet worden opgeëist, waardoor agent-gestuurde workflows soepeler verlopen.

Agents op lokale GPU's. Nieuwe kwantiseringstechnieken en kosteneffectieve GPU-opstellingen draaien nu MoE-modellen op consumentenhardware, maar benchmarks tonen aan dat kwantiseringen met lagere bits agentische taken ernstig kunnen verslechteren, wat oproept tot een zorgvuldige selectie van kwant.

Beveiliging, Juridisch & Interpreteerbaarheid

Jacobian Lens brengt modelgeest in kaart. Anthropic's Jacobian Lens onthult een kleine set van verwoordbare representaties die de kernredenering van een model vastleggen, waardoor hallucinatiedetectie, outputsturing en, zoals communitydemo's laten zien, onmiddellijke creatie van schadelijke varianten mogelijk wordt.

Agent-gestuurde ransomware. Sysdig documenteerde een AI-agent die de technische uitvoering van een ransomware-aanval afhandelde, hoewel een mens de operatie opzette, wat de huidige capaciteiten en beperkingen van agentische malware benadrukt.

AI-misbruikcrises. Een rechtszaak beweert dat xAI's Grok CSAM-afbeeldingen genereerde, terwijl Boko Haram chatbots gebruikt voor aanvalsplanning; de incidenten onderstrepen de dringende behoefte aan veiligheidsmaatregelen nu agentische capaciteiten toenemen.

Apple spant rechtszaak aan tegen OpenAI. Apple heeft een federale rechtszaak aangespannen waarin het OpenAI beschuldigt van het wegkapen van meer dan 400 werknemers om hardwarebedrijfsgeheimen te stelen, mogelijk om een rivaliserende AI-smartphone te bouwen, wat de juridische strijd in de AI-industrie intensiveert.

Dat was het weekoverzicht - tot volgende week zondag.

Lees het elke ochtend, direct in je browser

De extensie opent deze samenvatting in het zijpaneel van Chrome — één klik, geen account.

Toevoegen aan Chrome — Gratis