Model- en agentreleases
Grok 4.6 en Grok Bot. SpaceXAI bracht Grok 4.6 uit, dat gelijk staat aan OpenAI's GPT-5.6 Sol en op de Artificial Analysis-index alleen achterblijft bij Claude Opus 5, terwijl het de toonaangevende prijzen onderbiedt, en introduceerde Grok Bot, een altijd actieve AI-teamgenoot die vanaf zijn eigen cloudcomputer werkt om toegewezen taken uit te voeren.
Qwen 3.8 groot en klein. Qwen3.8-2.4T-A95B is nu beschikbaar en een 27B Qwen3.8-pagina verscheen kort op ModelScope voordat deze werd verwijderd, wat duidt op een aanstaande release. Liefhebbers van lokaal draaien plannen al hardware-opsplitsingen voor het 2.4T-model.
DeepSeek V4 Pro-update. DeepSeek's V4 Pro 0813 is beschikbaar via API op OpenRouter, zonder officiële aankondigingspagina; open gewichten zijn waarschijnlijk gezien eerdere releases. Het redeneergedrag verschilt merkbaar tussen lage, gemiddelde en hoge redeneerniveaus.
Edge-visiemodellen. Liquid AI's LFM2.5-VL-3B biedt veel sterkere UI-grounding en kan op telefoons draaien, terwijl Cohere's Apache-2.0 North Micro Vision ondersteuning biedt voor afbeeldingen op native resolutie in een compact pakket met 2,4 miljard parameters.
Nvidia's biljoen-parametermodel. Nvidia bouwt naar verluidt Nemotron 4 met ten minste één biljoen parameters en verdrievoudigt de cloudtrainingsuitgaven tot $28 miljard tot en met 2031, met als doel te concurreren met Chinese open-gewichtenmodellen.
Agentontwikkeling en -tools
Beheerde agents en BYOC. LangChain lanceerde Managed Deep Agents als de volgende stap na frameworks en maakte LangSmith BYOC algemeen beschikbaar op AWS, waardoor ondernemingen agenttraces en gegevens binnen hun eigen VPC kunnen houden.
ChatGPT-app op Linux. OpenAI bracht een Linux-desktopapp uit met ChatGPT, ChatGPT Work en Codex, maar native computerbediening is bij de lancering niet beschikbaar.
Lokale inferentie en hardware
RTX PRO 6000-prijs verdubbeld. Nvidia verdubbelde bijna de adviesprijs van de 96GB RTX PRO 6000 Blackwell naar $16.000, nadat voorbestellingen vorig jaar onder de $8.000 lagen.
DSpark-streaming op één GPU. Een enkele RTX PRO 6000 96GB kan DeepSeek V4 Flash 284B draaien met ongeveer 31 tokens per seconde met DSpark's drafter in systeem-RAM, ongeveer 15-17% sneller dan de baseline zonder drafter bij gelijk VRAM-gebruik.
Muse Glimmer op Mac. Meta's Muse Glimmer 30B draait nu tot ongeveer 3,3x sneller op Apple Silicon met mlx-dspark, en levert 8-bit kwaliteit tegen bijna 4-bit snelheden op een 48GB Mac.
Gemma 4 KV-cachekwantisatie. Kwantisatiebewuste training helpt Gemma 4 31B om kwaliteit te behouden onder agressieve KV-cachekwantisatie, waardoor inferentie met grote context praktischer wordt.
Industrie en bedrijfsleven
Cognition financiering tegen $40B. AI-codingagentmaker Cognition is naar verluidt in gesprek om kapitaal op te halen tegen een waardering van $40 miljard, na het bereiken van een geannualiseerde omzetrunrate van $1 miljard, tegenover $492 miljoen drie maanden geleden.
Lovable bereikt $13,3B. Vibe-codingstartup Lovable haalde $400 miljoen op tegen een waardering van $13,3 miljard, na het overschrijden van $500 miljoen aan geannualiseerde omzet, met 60 miljoen gehoste projecten.
Thrive Holdings enterprise-AI. Het door OpenAI gesteunde Thrive Holdings haalde $2 miljard op tegen een waardering van $12 miljard om traditionele bedrijven over te nemen en AI te implementeren, en breidt daarmee uit buiten accounting en IT.
Gemini-marktaandeel daalt. Marktgegevens van Pangram, OpenRouter en Similarweb laten zien dat het Gemini-gebruik afneemt, waarbij Pangram een daling naar 1,9% van AI-schrijfwerk registreert, terwijl OpenAI meer dan 50% in handen heeft.
Claude richt zich op juridisch. Anthropic heeft juridische-AI-oprichter Robert Mahari aangesteld als eerste Head of Claude for Legal, voortbouwend op eerdere juridische plug-ins en partnerschappen.
Beleid, beveiliging en samenleving
LiteLLM-toeleveringsketenlek. Een aanval op de toeleveringsketen van LiteLLM legde terabytes aan inloggegevens bloot van meer dan 2.500 organisaties, waaronder Microsoft, Amazon en Samsung, via kwaadaardige PyPI-pakketten.
Claude-outputwatermerken. Anthropic voorziet Claude-outputs nu van watermerken om te voldoen aan de EU AI Act, tot ongenoegen van gebruikers die vrezen dat het AI-gebruik in werk of school zal onthullen.
Twitch traint standaard. Twitch zal standaard Amazon AI-modellen trainen op content van streamers, met een opt-outknop die nu beschikbaar is; het beleid heeft verzet veroorzaakt.
ShieldFont vervangt tekst. Ontwerpers brachten ShieldFont uit, een lettertype dat normale tekst aan gebruikers toont, maar woorden in de onderliggende HTML vervangt om scrapers te vergiftigen.
Hinton, Li en Ng over open AI. Op Ai4 pleitten Geoffrey Hinton, Fei-Fei Li en Andrew Ng voor het open houden van AI om te voorkomen dat een paar bedrijven de toegang controleren, ondanks veiligheidszorgen over open gewichten.
Zeldzame boeken vernietigd. Boekverkopers vrezen dat AI-bedrijven zeldzame boeken opkopen en vernietigen voor training, ondanks niet-destructieve scanalternatieven.
Onderzoek en benchmarks
MindTopo-topologiereasoning. Microsoft Research's MindTopo-benchmark toont aan dat multimodale modellen goed zijn in statische topologische herkenning, maar moeite hebben met interactieve planning die vereist dat relaties in de loop van de tijd worden onderhouden.
Prompts gereconstrueerd uit output. IIT Bombay en Adobe Research ontwikkelden Previous-Token Prediction, dat LLM-prompts uit outputtekst kan reconstrueren met bijna perfecte nauwkeurigheid, zonder modelgewichten.
Dat was het voor vandaag - ongeveer 5 minuten leestijd.