Modelreleases & updates
Ox Alpha stealthmodel. Een nieuw stealthmodel met de naam Ox Alpha lijkt gebaseerd te zijn op GLM of Mimo, maar details zijn onbevestigd. Het wordt omschreven als een frontier-model voor efficiënt coderen, langdurig agentic werk en productiegebruik.
SenseNova U1.5-Lite. SenseNova heeft U1.5-Lite uitgebracht, een enkel uniform model dat taakspecifieke experts bundelt voor tekstweergave, esthetiek en beeldbewerking. Het verbetert het opvolgen van complexe instructies, native 4K-generatie en bewerkingsnauwkeurigheid.
Tencent Hunyuan Hy4. Tencent is begonnen met een grijze test van zijn nieuwe vlaggenschip Hunyuan Hy4 in de Yuanbao-app, dat wordt aangemerkt als een model op expertniveau met toolgebruik. Het wordt gepositioneerd boven Hy3 en DeepSeek.
Anthropic Model 2 intern. Uit het risicorapport van Anthropic blijkt dat zijn capabelste model, met de codenaam Model 2, alleen voor intern gebruik is. Het presteert beter dan de openbare Claude-modellen en wordt veel gebruikt voor coderen en onderzoek.
Ling-3.0 base checkpoints. AntLing heeft zes base checkpoints voor Ling-3.0 uitgebracht, in twee formaten en drie trainingsfasen. Ze vallen allemaal onder de MIT-licentie en zijn bedoeld voor voortgezette pretraining en onderzoek.
Agentproducten & platforms
ChatGPT Messages-plug-in. OpenAI heeft een Apple Messages-plug-in gelanceerd waarmee ChatGPT berichten kan analyseren, opstellen en versturen. De plug-in werkt samen met Codex en ChatGPT Work. Details over privacy zijn nog onduidelijk.
Meta AI Mac-app. Meta heeft een Mac-app uitgebracht met systeembrede dicteer- en schermherkenning via Muse Spark. Ook zijn er zakelijke integraties toegevoegd voor advertenties en Google Workspace.
Slack Code-kanalen. Slack heeft samenwerkingskanalen voor vibe-coding geïntroduceerd waar teams AI-agents zoals Claude of Devin kunnen taggen, diffs kunnen beoordelen en output kunnen previewen voordat ze die uitrollen.
Binance Agent OS. Binance heeft Agent OS gelanceerd, een platform waarmee AI-agents markten kunnen analyseren en transacties kunnen uitvoeren, met door gebruikers ingestelde limieten en MCP-ondersteuning.
Ramp lanceert Router. Ramp heeft Router gelanceerd, een dienst voor AI-modelrouting die toegang biedt tot meerdere LLM-providers en strategieën. De dienst is de rest van 2026 gratis.
Tools & frameworks
LangSmith Preview Builds. LangSmith heeft Preview Builds toegevoegd, waarmee teams agentwijzigingen uit PR-branches kunnen testen in geïsoleerde productieachtige omgevingen voordat ze mergen.
NVIDIA CUDA MCP. NVIDIA heeft een gehoste CUDA MCP-server uitgebracht voor AI-ondersteunde CUDA-bewerkingen, zoals het doorzoeken van officiële documentatie, het schrijven van geoptimaliseerde GPU-code en het analyseren van prestaties.
/wayfinder skill. Matt Pocock heeft /wayfinder uitgebracht, een skill die agents helpt bij het plannen van projecten met onduidelijke eindtoestanden. Het pakt 'fog of war'-planning aan.
LFM2.5-DSpark. Hugging Face heeft DSpark aangekondigd voor LFM2.5-modellen. Het levert tot 3,2x snellere inferentie op GPU en 2,87x op het apparaat, met 57% lagere function-calling-latentie.
Onderzoek & benchmarks
Qwen3.8-27B-prestaties. Een ontwikkelaar heeft Qwen3.8-27B geoptimaliseerd naar 381 tps op een RTX 3090. Het model scoort 29/30 op AIME 2026 met FP8 en hoge reasoning, waarmee het Claude Opus 4.6 evenaart.
GEN-1.5 one-shot robot. GEN-1.5 van Generalist AI leert robots nieuwe taken aan de hand van één demo van 3 tot 12 seconden, met gemiddeld 59% succes. Met 10 trainingsstappen is dat 83%.
AI-geschreven webpagina's. Uit onderzoek van Pew Research blijkt dat meer dan een derde van de webpagina's die sinds ChatGPT zijn gepubliceerd, sporen van AI-auteurschap vertonen. Dit is gebaseerd op Pangram-detectie op Common Crawl-gegevens.
Guardrails maken AI detecteerbaar. De CTO van Pangram betoogt dat post-training guardrails mode collapse veroorzaken, waardoor LLM-tekst detecteerbaar wordt. Basismodellen en gespecialiseerde fine-tunes omzeilen detectie.
Sutton over synthetische data. Richard Sutton betoogt dat synthetische data het schalen niet zal oplossen. Hij noemt het een 'grote vergissing' vanwege de oneindige complexiteit van de wereld.
Tao over wiskundecrisis. Terence Tao zegt dat AI de grootste crisis in de wiskunde sinds Gödel kan veroorzaken. Het dwingt tot een herevaluatie van wat telt als wiskundige bijdrage.
Industrie & bedrijfsleven
Micro1-datahausse. AI-trainingdatastartup Micro1 zag zijn gross run rate in acht maanden groeien van $100M naar $500M. Het netto ligt rond de $150-200M, te midden van een fors toenemende vraag naar unieke AI-trainingdata.
OpenAI vs Anthropic. Volgens gegevens van Ramp ligt Anthropic met 44% tegenover 40% voor op OpenAI onder Amerikaanse zakelijke gebruikers. Toch groeit OpenAI tot nu toe in Q3 sneller.
Runlayer/Rippling-rechtszaak. Runlayer en Rippling hebben de rechtszaken over concurrentie rond MCP-gateways ingetrokken. Rippling vierde dat door onmiddellijk zijn MCP-gateway uit te brengen.
Brockmans OpenAI. Greg Brockman heeft in stilte macht vergaard bij OpenAI. Als president leidt hij de dagelijkse gang van zaken, terwijl Sam Altman CEO blijft, in aanloop naar de beursgang.
China AI-inhaalslag. Een analyse van Decoder stelt dat China's Kimi K3 en GLM-5.3 binnen handbereik liggen van Amerikaanse modellen. De moat verschuift daarmee van een voorsprong in modellen naar andere factoren.
Unitree circulaire financiering. De $50B-IPO-waardering van het Chinese Unitree rust op door de staat gesteunde centra die robots kopen en trainingsdata terugverkopen. Dat roept zorgen op over circulaire financiering.
Beveiliging & betrouwbaarheid
Grok prompt-injectieaanval. Onderzoekers hebben aangetoond dat Grok gebruikersgegevens exfiltreert wanneer kwaadaardige instructies zijn versleuteld. xAI werd in juni geïnformeerd, maar het probleem blijft bestaan.
Grok gibberish-bug. Grok stuurt bij sommige gebruikers op Grok.com onsamenhangende antwoorden. xAI bevestigt dat het om een zeldzaam tijdelijk generatieprobleem gaat.
Dat was het voor vandaag - ongeveer 5 minuten leestijd.