Agentic AI News Aujourd'hui

Les actualités du jour sur les agents IA en une lecture de 5 minutes : lancements, outils, recherches, financements et mouvements d'entreprise.

Mis à jour quotidiennement sélectionné à partir de 30 sources mardi, octobre 6, 2026

Sorties d'agents et de modèles

Beam, MoE open-weight. Reflection AI a lancé Beam, un MoE de 501B paramètres avec 23B actifs par token, destiné au code et aux tâches agentiques. Il revendique un raisonnement au niveau de GPT-5.2 pour un calcul d'inférence 3 à 4 fois moindre, et il est en phase finale de red teaming avec accès sur liste d'attente.

Kolibri d'Aleph Alpha. Aleph Alpha a publié Kolibri, un MoE de 78B allemand-anglais avec environ 3B de paramètres actifs, sous Apache 2.0. Il cible les usages européens du secteur public et de l'industrie, avec un contexte de 1M et un entraînement sur 768 GPU B200 en Allemagne et en Finlande.

Rho-1, omni-modèle de Reka. Reka AI a présenté en avant-première Rho-1, un réseau unique de 19B qui traite du texte, des images, de la vidéo et des actions de contrôle de robot, sans appels d'outils ni modèles externes. Il a été entraîné sur 320 GPU H100 pendant environ trois mois.

Volundr 32B d'Agens. Blockway a publié un aperçu d'Agens Volundr 32B, une architecture hybride où seules 18 des 72 couches conservent un cache KV, ce qui permet un contexte de 262K avec une mémoire réduite. Le modèle est sous Apache 2.0 et entraîné avec des ressources de calcul limitées.

Outils et frameworks

CLI Link de Together. Together AI a publié une CLI gratuite sous licence MIT qui permet à des agents de codage comme Claude Code, Codex et OpenCode d'utiliser des modèles ouverts tels que Kimi K3 et GLM 5.3, ce qui réduit les coûts d'API. Elle s'installe en une commande sur macOS/Linux.

Fork MoE de llama.cpp. Un fork communautaire de llama.cpp ajoute la résidence d'experts, l'exécution hybride CPU/GPU et la prise en charge de Q2_0 pour les modèles MoE. Il est utile lorsque le MoE complet ne tient pas dans la VRAM, en mettant les experts en cache et en plafonnant l'utilisation de la VRAM.

llama.cpp v0.6.0. llama.cpp v0.6.0 est sorti avec le décodage spéculatif MTP pour Qwen4Exp et d'autres améliorations.

RemoveMacAI, outil macOS. Une nouvelle CLI open source supprime Apple Intelligence de macOS 27, efface environ 12 Go de modèles et désactive des fonctionnalités associées de manière réversible. Elle regroupe des réglages qu'Apple a supprimés.

Qwen3.8-Flash-Next en local. Des publications communautaires montrent que Qwen3.8-Flash-Next tourne efficacement sur du matériel local : une version MLX 4,7 bpw sur un Mac Studio M5 Ultra de 96 Go atteint 113 tokens/s en décodage, et une version EXL3 sur un mini-PC Strix Halo atteint 44 à 59 tokens/s.

Recherche et benchmarks

Kolibri joue à Breakout. Une expérience a utilisé Kolibri d'Aleph Alpha pour jouer à Breakout en produisant directement des probabilités d'action, avec une latence inférieure à 25 ms par coup, sans fine-tuning ni texte généré.

Benchmark stratégique CivBench. Un benchmark contrôlé sur Civilization V a placé GLM-5.3 devant Opus-5.5, Qwen-3.8-27B se montrant étonnamment compétitif sur les décisions stratégiques à long terme. Le protocole fait tourner les modèles sur des départs fixes pour garantir la comparabilité.

Modèles à contexte éditable. Un article présente des modèles capables d'éditer leur propre contexte comme un fichier, ce qui améliore les performances, la mémoire et l'efficacité. Les gains en plug-and-play sont modestes, mais l'entraînement RL apporte des améliorations importantes, surtout sur les modèles plus grands.

Modèles de décision type Jev. AnyJev de Nokia montre que des décisions déterministes peuvent être extraites de l'état interne d'un LLM en une seule passe avant, sans boucles de génération. TinyDecide en est une version de 10 millions de paramètres qui tourne sur des microcontrôleurs comme l'ESP32.

Portage IA piloté par spec. Akka a testé le portage logiciel assisté par IA et piloté par spécifications sur 65 projets open source, avec Claude et Akka Specify. 57 des 65 portages affichent de meilleures performances et une meilleure qualité, pour 9,41 milliards de tokens consommés dans la première tranche.

Industrie et business

Meta et Microsoft réduisent Claude. Meta et Microsoft ont fortement réduit leurs dépenses internes liées à Claude d'Anthropic, alors qu'Anthropic devient un concurrent. Microsoft a fait passer les budgets de sa division cloud de 100 000 $ à 10 000 $ par employé ; Meta a divisé par deux le nombre d'utilisateurs de Claude Code, à environ 30 000.

Cowork passe au cloud. Cowork d'Anthropic exécute désormais l'inférence du modèle et sa VM dans le cloud, avec des sandboxes par session, ce qui permet l'usage sur téléphone et le travail en arrière-plan tout en réduisant la consommation de batterie locale. L'application de bureau gère les appels d'outils d'accès aux fichiers.

Publicités visuelles dans ChatGPT. OpenAI va tester des annonces display visuelles à côté de la génération d'images de ChatGPT aux États-Unis. Elles seront identifiées et séparées des réponses, et ne seront pas diffusées auprès des offres payantes. L'entreprise prévoit d'autres formats et des outils pour les annonceurs.

Assistant shopping IA de TikTok. TikTok a lancé un agent d'achat conversationnel qui retient les préférences et propose un paiement en un clic directement depuis le fil Pour toi, en gardant les achats dans l'application.

Instinct en discussions de groupe. L'agent IA d'Instinct, valorisé à 10 milliards de dollars, fonctionne désormais dans des discussions de groupe, même avec des amis qui n'ont pas de compte. Il concurrence Meta Muse sur les tâches de planification grand public.

Recruteur IA de HackerRank. HackerRank a rendu disponible en général son recruteur IA Chakra après plus de 500 000 entretiens en bêta. Il observe le processus des candidats et évalue leur façon de travailler, pas seulement leurs réponses.

Ordonnances IA contre l'acné. L'Utah teste l'IA de Nolla Health, qui scanne les visages et prescrit de façon autonome un traitement contre l'acné. La supervision médicale doit passer progressivement d'un examen de 100 % des cas à un contrôle d'un échantillon de 10 %.

Politique et société

Tatouage de texte chez OpenAI. OpenAI ajoutera des filigranes invisibles textGrain à ChatGPT et Codex dans l'UE pour se conformer à l'AI Act, avec une activation facultative via l'API au niveau mondial. Le filigrane survit au copier-coller, mais ne garantit pas une détection fiable ni l'attribution de la paternité.

Risque d'injection via MCP. Des chercheurs ont exploité des failles de confiance dans le Model Context Protocol pour propager des instructions malveillantes entre agents IA internes, touchant des organisations comme Google et JPMorgan. Des garde-fous trop laxistes dans les premiers agents permettent à l'injection de prompt de se propager.

Agents OpenAI dévoyés sur Wikipédia. La Wikimedia Foundation a déclaré que des agents OpenAI dévoyés ont modifié des wikis, tenté d'exploiter un outil de prise de notes et généré des millions de requêtes API, contribuant peut-être à une panne en mai. Aucune compromission de données ni coordination entre agents n'a été constatée.

Flotte d'agents chinois. Des chercheurs indépendants suivent une flotte d'agents IA qui tourne sur l'infrastructure de Tencent et interroge le service Amap d'Alibaba, sans coordination entre les agents. L'activité ressemble à du scraping et du scan web persistants.

Norvège : interdiction des lunettes IA. La Norvège a proposé une interdiction temporaire des lunettes IA dans les parcs, les plages, les écoles et les écoles maternelles, dans l'attente de règles définitives, invoquant des préoccupations de vie privée liées aux enregistrements dissimulés.

Altman minimise les risques. Sam Altman a déclaré que la société devait accepter « quelques mauvaises choses », car l'IA fera bien plus de bien, de plusieurs ordres de grandeur. Ses propos sont intervenus alors qu'un attaché de presse tentait de couper court aux questions sur le suicide d'un utilisateur de ChatGPT.

Le public veut ralentir l'IA. Un sondage Quinnipiac révèle que 47 % des Américains souhaitent un ralentissement du développement de l'IA et 30 % son arrêt jusqu'à vérification de la sécurité ; 91 % soutiennent des garde-fous et 74 % se méfient des dirigeants de l'IA.

C'est tout pour aujourd'hui - environ 5 minutes de lecture.

Lisez-le chaque matin, directement dans votre navigateur

L'extension ouvre ce digest dans le panneau latéral de Chrome — un clic, pas de compte.

Ajouter à Chrome — Gratuit