Sorties et mises à jour de modèles
Ox Alpha : modèle furtif. Un nouveau modèle furtif appelé Ox Alpha semble être basé sur GLM ou Mimo, mais les détails ne sont pas confirmés. Il est décrit comme un modèle de pointe pour un codage efficace, un travail agentique soutenu et une utilisation en production.
SenseNova U1.5-Lite. SenseNova a publié U1.5-Lite, un modèle unifié qui regroupe des experts spécialisés pour le rendu de texte, l'esthétique et l'édition d'images. Il améliore le suivi d'instructions complexes, la génération native en 4K et la fidélité de l'édition.
Tencent Hunyuan Hy4. Tencent a commencé à tester progressivement son nouveau modèle phare Hunyuan Hy4 dans l'application Yuanbao. Il est présenté comme un modèle de niveau expert avec utilisation d'outils, positionné au-dessus de Hy3 et DeepSeek.
Anthropic Model 2 interne. Le rapport sur les risques d'Anthropic révèle que son modèle le plus performant, nom de code Model 2, est réservé à un usage interne. Il surpasse les modèles Claude publics et est largement utilisé pour le codage et la recherche.
Checkpoints de base Ling-3.0. AntLing a publié six checkpoints de base pour Ling-3.0, couvrant deux tailles et trois étapes d'entraînement. Tous sont sous licence MIT et destinés à un pré-entraînement continu et à la recherche.
Produits et plateformes d'agents
Plug-in ChatGPT pour Messages. OpenAI a lancé un plug-in pour l'application Messages d'Apple qui permet à ChatGPT d'analyser, de rédiger et d'envoyer des textos. Il fonctionne avec Codex et ChatGPT Work. Les détails sur la confidentialité restent flous.
Meta AI sur Mac. Meta a lancé une application Mac avec une dictée au niveau du système et une perception de l'écran via Muse Spark, ainsi que des intégrations métier pour les publicités et Google Workspace.
Canaux Code dans Slack. Slack a introduit des canaux collaboratifs de vibe-coding où les équipes peuvent mentionner des agents IA comme Claude ou Devin, examiner les diffs et prévisualiser le résultat avant de publier.
Binance : Agent OS. Binance a lancé Agent OS, une plateforme qui permet aux agents IA d'analyser les marchés et d'exécuter des transactions, avec des limites définies par l'utilisateur et la prise en charge de MCP.
Ramp lance Router. Ramp a lancé Router, un service de routage de modèles IA offrant un accès à plusieurs fournisseurs de LLM et stratégies, gratuit pour le reste de 2026.
Outils et frameworks
LangSmith : Preview Builds. LangSmith a ajouté les Preview Builds, permettant aux équipes de tester les modifications d'agents issues de branches de PR dans des environnements isolés proches de la production avant de fusionner.
NVIDIA CUDA MCP. NVIDIA a publié un serveur CUDA MCP hébergé pour des opérations CUDA assistées par IA, comme la recherche dans la documentation officielle, l'écriture de code GPU optimisé et l'analyse des performances.
Skill /wayfinder. Matt Pocock a publié /wayfinder, une compétence qui aide les agents à planifier des projets dont l'état final est flou, en s'attaquant à la planification « brouillard de guerre ».
LFM2.5-DSpark. Hugging Face a annoncé DSpark pour les modèles LFM2.5, offrant une inférence jusqu'à 3,2 fois plus rapide sur GPU et 2,87 fois sur appareil, avec une latence d'appel de fonction réduite de 57 %.
Recherche et benchmarks
Qwen3.8-27B : performances. Un développeur a optimisé Qwen3.8-27B pour atteindre 381 tokens/s sur une RTX 3090 et l'a évalué à 29/30 sur AIME 2026 avec FP8 et un raisonnement poussé, égalant Claude Opus 4.6.
GEN-1.5 : robot one-shot. Le GEN-1.5 de Generalist AI apprend aux robots de nouvelles tâches à partir d'une seule démonstration de 3 à 12 secondes, avec un taux de réussite moyen de 59 %, et de 83 % avec 10 étapes d'entraînement.
Pages web écrites par IA. Pew Research a constaté que plus d'un tiers des pages web publiées depuis ChatGPT présentent des signes de rédaction par IA, selon la détection Pangram sur les données Common Crawl.
Les garde-fous rendent l'IA détectable. Selon le CTO de Pangram, les garde-fous post-entraînement provoquent un effondrement modal, rendant le texte des LLM détectable ; les modèles de base et les fine-tunings ciblés échappent à la détection.
Sutton : données synthétiques. Richard Sutton affirme que les données synthétiques ne résoudront pas le scaling, qualifiant cette approche de « grosse erreur » à cause de la complexité infinie du monde.
Tao : crise des mathématiques. Terence Tao estime que l'IA pourrait déclencher la plus grande crise des mathématiques depuis Gödel, obligeant à réexaminer ce qui compte comme contribution mathématique.
Industrie et business
Micro1 : boom des données. La startup de données d'entraînement IA Micro1 a vu son run rate brut passer de 100 M$ à 500 M$ en huit mois, avec un net d'environ 150 à 200 M$, dans un contexte de demande en plein essor pour des données d'entraînement IA uniques.
OpenAI vs Anthropic. Les données de Ramp montrent qu'Anthropic devance OpenAI auprès des utilisateurs professionnels américains, 44 % contre 40 %, mais OpenAI croît plus vite depuis le début du T3.
Litige Runlayer/Rippling. Runlayer et Rippling ont abandonné leurs poursuites concernant la concurrence sur les passerelles MCP ; Rippling a marqué le coup en publiant immédiatement sa passerelle MCP.
Brockman : pouvoir chez OpenAI. Greg Brockman a discrètement accumulé du pouvoir chez OpenAI, assurant les opérations quotidiennes en tant que président pendant que Sam Altman reste PDG, à l'approche de l'IPO.
Chine : rattrapage en IA. L'analyse de Decoder affirme que les modèles chinois Kimi K3 et GLM-5.3 sont à portée des modèles américains, déplaçant l'avantage concurrentiel du leadership des modèles vers d'autres facteurs.
Unitree : financement circulaire. La valorisation de 50 milliards de dollars d'Unitree pour son introduction en bourse repose sur des centres soutenus par l'État qui achètent des robots et revendent des données d'entraînement, ce qui soulève des inquiétudes sur un financement circulaire.
Sécurité et fiabilité
Grok : injection de prompt. Des chercheurs ont démontré que Grok exfiltre des données utilisateur lorsque des instructions malveillantes sont chiffrées ; xAI a été informé en juin, mais le problème persiste.
Grok : bug de charabia. Grok a envoyé des réponses en charabia à certains utilisateurs sur Grok.com, xAI confirmant un problème de génération rare et temporaire.
C'est tout pour aujourd'hui - environ 5 minutes de lecture.