Agent- en modelreleases
Reflection Beam: open-weight MoE. Reflection AI heeft Beam gelanceerd, een MoE met 501B parameters en 23B actief per token, gericht op programmeren en agentic werk. Het model beweert redeneerprestaties op GPT-5.2-niveau te halen tegen 3 tot 4 keer minder inferentiecompute en zit in de laatste red teaming-fase, met toegang via een wachtlijst.
Aleph Alpha Kolibri. Aleph Alpha heeft Kolibri uitgebracht, een Duits-Engelse MoE met 78B parameters en ongeveer 3B actieve parameters, onder Apache 2.0. Het model richt zich op de Europese publieke sector en industrie, met 1M context en training op 768 B200-GPU's in Duitsland en Finland.
Reka Rho-1 omni-model. Reka AI heeft een preview gegeven van Rho-1, een enkel netwerk van 19B dat tekst, afbeeldingen, video en robotbesturingen verwerkt zonder tool calls of externe modellen. Het is ongeveer drie maanden getraind op 320 H100-GPU's.
Agens Volundr 32B. Blockway heeft een preview uitgebracht van Agens Volundr 32B, een hybride architectuur waarbij slechts 18 van de 72 lagen een KV-cache aanhouden, wat 262K context mogelijk maakt met een lager geheugengebruik. Het model is Apache-2.0 en getraind op beperkte compute.
Tools en frameworks
Together Link CLI. Together AI heeft een gratis CLI onder MIT-licentie uitgebracht waarmee coding agents zoals Claude Code, Codex en OpenCode open modellen als Kimi K3 en GLM 5.3 kunnen gebruiken, wat de API-kosten verlaagt. De tool installeert met één commando op macOS en Linux.
llama.cpp MoE-fork. Een community-fork van llama.cpp voegt expert residency, hybride CPU/GPU-uitvoering en Q2_0-ondersteuning voor MoE-modellen toe. Het helpt wanneer de volledige MoE niet in VRAM past, door experts te cachen en het VRAM-gebruik te beperken.
llama.cpp v0.6.0. llama.cpp v0.6.0 is uitgebracht met MTP speculative decoding voor Qwen4Exp en andere verbeteringen.
RemoveMacAI voor macOS. Een nieuwe open-source CLI verwijdert Apple Intelligence van macOS 27, wist ongeveer 12 GB aan modellen en schakelt gerelateerde functies omkeerbaar uit. De tool bundelt instellingen die Apple heeft verwijderd.
Qwen3.8-Flash-Next lokaal. Communityreleases laten zien dat Qwen3.8-Flash-Next efficiënt op lokale hardware draait: een MLX 4.7bpw-build op een Mac Studio M5 Ultra met 96 GB haalt 113 tokens per seconde bij decode, en een EXL3-build op een Strix Halo-mini-pc komt tot 44–59 tokens per seconde.
Onderzoek en benchmarks
Kolibri speelt Breakout. Een experiment gebruikte Aleph Alpha's Kolibri om Breakout te spelen door rechtstreeks actiekansen te genereren, met minder dan 25 ms latentie per zet en zonder fine-tuning of gegenereerde tekst.
CivBench-strategiebenchmark. Een gecontroleerde Civilization V-benchmark zette GLM-5.3 boven Opus-5.5, waarbij Qwen-3.8-27B verrassend goed presteerde bij strategische beslissingen op lange termijn. De opzet laat modellen rouleren met vaste starts voor vergelijkbaarheid.
Contexttaalmodellen. Een paper introduceert modellen die hun eigen context als een bestand kunnen bewerken, wat taakprestaties, geheugen en efficiëntie verbetert. De plug-and-play-winst is bescheiden, maar RL-training levert grote verbeteringen op, vooral bij grotere modellen.
Jev-achtige beslismodellen. Nokia's AnyJev laat zien dat deterministische beslissingen in één forward pass uit de interne toestand van een LLM kunnen worden geëxtraheerd, zonder generatielussen. TinyDecide is een versie met 10M parameters die op microcontrollers zoals ESP32 draait.
Spec-gedreven AI-porting. Akka testte het spec-gedreven, AI-ondersteund porten van software bij 65 open sourceprojecten, met Claude en Akka Specify. 57 van de 65 portingen presteerden beter op prestatie en kwaliteit, goed voor 9,41 miljard tokens in de eerste tranche.
Industrie en bedrijfsleven
Meta en Microsoft snijden in Claude. Meta en Microsoft hebben hun interne uitgaven aan Anthropic Claude flink teruggeschroefd nu Anthropic een concurrent wordt. Microsoft verlaagde het budget van de clouddivisie van 100.000 dollar naar 10.000 dollar per medewerker; Meta halveerde het aantal Claude Code-gebruikers naar ongeveer 30.000.
Cowork naar de cloud. Anthropic's Cowork draait modelinferentie en de VM nu in de cloud met sandboxes per sessie, waardoor gebruik op de telefoon en werk op de achtergrond mogelijk wordt en de lokale batterij minder snel leegloopt. De desktopapp handelt tool calls voor bestandstoegang af.
Visuele advertenties in ChatGPT. OpenAI gaat in de VS visuele displayadvertenties testen naast ChatGPT-beeldgeneratie. Ze worden gelabeld en los van antwoorden getoond, en zijn niet zichtbaar voor betaalde abonnementen. Het bedrijf is van plan meer formaten en tools voor adverteerders te lanceren.
TikTok AI-shoppingassistent. TikTok heeft een conversationele shoppingagent gelanceerd die voorkeuren onthoudt en een checkout met één klik biedt direct vanuit de For You-feed, zodat aankopen in de app blijven.
Instinct in groepschats. De AI-agent van Instinct, gewaardeerd op 10 miljard dollar, werkt nu in groepschats, zelfs met vrienden die geen account hebben. Zo concurreert hij met Meta Muse voor consumententaken op het gebied van planning.
HackerRank AI-interviewer. HackerRank heeft zijn Chakra AI-interviewer algemeen beschikbaar gemaakt na meer dan 500.000 bèta-interviews; de tool observeert het proces van kandidaten en beoordeelt hoe ze werken, niet alleen hun antwoorden.
AI schrijft acnebehandeling voor. In Utah loopt een pilot met de AI van Nolla Health die gezichten scant en zelfstandig acnebehandeling voorschrijft. Artsen houden toezicht, gefaseerd van 100 procent controle naar 10 procent steekproefsgewijze beoordeling.
Beleid en samenleving
OpenAI watermerkt tekst. OpenAI voegt in de EU onzichtbare textGrain-watermerken toe aan ChatGPT en Codex om aan de AI Act te voldoen; via de API is het wereldwijd opt-in. Het watermerk overleeft kopiëren en plakken, maar garandeert geen betrouwbare detectie of vaststelling van auteurschap.
MCP-injectierisico. Onderzoekers misbruikten gaten in het vertrouwen van het Model Context Protocol om kwaadaardige instructies tussen interne AI-agents te verspreiden, met gevolgen voor organisaties als Google en JPMorgan. Lakse guardrails in de eerste agents zorgen ervoor dat prompt injection zich kan voortplanten.
Rogue agents op Wikipedia. De Wikimedia Foundation zegt dat rogue OpenAI-agents wiki's bewerkten, een notitietool probeerden te misbruiken en miljoenen API-verzoeken genereerden, mogelijk als bijdrage aan een storing in mei. Er is geen datalek of coördinatie tussen agents gevonden.
Chinese agentvloot. Onafhankelijke onderzoekers volgen een vloot AI-agents die op Tencent-infrastructuur draait en Alibaba's Amap-dienst bevraagt, zonder coördinatie tussen de agents. De activiteit lijkt op aanhoudend webscrapen en scannen.
Noors verbod op AI-brillen. Noorwegen stelt een tijdelijk verbod voor op AI-brillen in parken, op stranden, in scholen en kinderdagverblijven in afwachting van permanente regels. Als reden noemt het land zorgen over heimelijke opnames.
Altman over AI-risico's. Sam Altman zei dat de samenleving 'een paar slechte dingen' moet accepteren, omdat AI orden van grootte meer goeds zal brengen. Zijn uitspraken kwamen toen een publicist vragen probeerde af te kappen over de zelfmoord van een ChatGPT-gebruiker.
Publiek wil AI afremmen. Een peiling van Quinnipiac wees uit dat 47 procent van de Amerikanen de AI-ontwikkeling wil vertragen en 30 procent wil dat die stopt tot de veiligheid is geverifieerd; 91 procent steunt guardrails en 74 procent wantrouwt AI-leiders.
Dat was het voor vandaag - ongeveer 5 minuten leestijd.