Agentic AI News Aujourd'hui

Les actualités du jour sur les agents IA en une lecture de 5 minutes : lancements, outils, recherches, financements et mouvements d'entreprise.

Mis à jour quotidiennement sélectionné à partir de 30 sources jeudi, octobre 8, 2026

Modèles et interfaces

Claude Haiku 5.5. Le nouveau modèle rapide et bon marché d'Anthropic offre un contexte de 1 M de tokens et ramène le prix des prompts à 0,10 $/M jusqu'à 100 K tokens, comme GPT-6 Luna. Mais son tokenizer compte environ 25 à 30 % de tokens en plus, et le tarif est multiplié par 5 au-delà de 100 K. Les benchmarks montrent un gros bond par rapport à Haiku 4.5 et des performances compétitives en codage agentique.

Mistral Large 4 « Le Chonk ». Mistral a publié en preview un modèle à poids ouverts de 1 000 milliards de paramètres, optimisé pour le code, la cyberdéfense et certains secteurs, et revendique des capacités proches des modèles de frontière américains et chinois.

Modèles de décision Liquid AI. Liquid AI a publié en open source d1-3B et d1-omni-600M, des modèles de décision multimodaux qui renvoient des réponses oui/non, par choix ou sous forme de score, calibrées et sans aucun token de sortie. d1-3B revendique la meilleure performance de sa catégorie sous 10 B sur le Decision Index et tourne en 16 ms seulement sur du matériel NVIDIA Jetson, avec en plus un portage navigateur en WebGPU.

API Decisions d'OpenAI. OpenAI a lancé en bêta l'API Decisions, pour des évaluations oui/non, par catégorie ou sur une échelle, à partir de texte ou d'images, environ 10 fois plus rapide que Responses. Elle prend en charge GPT-6 Luna à 0,10 $/M en entrée, les tokens de sortie étant gratuits.

UI intelligente de ChatGPT. Avec GPT-6, ChatGPT peut produire des graphiques interactifs, des boutons, des formulaires et des mini-applications au lieu de simple texte. OpenAI indique que le raisonnement démarre dès la phase de réflexion pour réduire l'attente : les utilisateurs payants ont droit à GPT-6 Sol, les gratuits à Luna.

Génération vidéo Kandinsky 6.0. Kandinsky Lab a publié Kandinsky 6.0 Pro (29 B) et Lite (3 B), compatibles ComfyUI et Diffusers, avec un upscaler vidéo en plus.

Nemotron en compétition. Des modèles Nemotron affinés ont décroché un niveau médaille d'or non officiel à l'IOI 2026 (535,4/600) et une médaille d'or officielle à l'IMO 2026 avec 30/42, en combinant SFT, RL et generate-verify-refine.

Agents et frameworks

Agents Nous Research. Nous Research a levé 90 M$ sur une valorisation de 1,5 Md$ et lance Hermes for Businesses, destiné aux agents IA en entreprise. Son Hermes Agent open source a été cloné 24 millions de fois et représenterait environ 2,5 % de la consommation mondiale de tokens IA.

Deep Agents de LangChain. LangChain a présenté des mises à jour de Skills, qui lient les outils aux compétences pour garder un contexte réduit, ainsi que Managed Deep Agents v0.9, avec des plannings créés par l'agent, une configuration par exécution et des réactions Slack.

Actions Copilot chez Microsoft. Hybrid Intelligence de Microsoft permettra à Copilot d'accéder aux fichiers locaux et d'agir dans tout Windows : retrouver, renommer, compresser ou envoyer des documents par e-mail pour l'utilisateur.

Muse de Meta sur iPad. Muse, l'assistant agentique de Meta, arrive en version native sur iPad après avoir atteint 6,6 millions d'installations. Il ajoute des connecteurs vers des outils comme Canva, GitHub et QuickBooks.

RL avec Agent Lightning. Microsoft Research a publié en open source Agent Lightning v1.0, un framework de RL agentique de 3 500 lignes qui s'appuie sur de vrais harnais de déploiement et sur Kubernetes natif. Dans un exemple, il fait passer le Pass@1 de Qwen3.5-9B sur SWE-bench Verified de 41,8 % à 56,4 %, avec environ 6 000 échantillons d'entraînement.

IA locale et outils de développement

ROCm 10.1. ROCm 10.1 d'AMD s'attaque au goulot d'étranglement des déplacements de données en inférence locale ; la sortie a été commentée par les utilisateurs d'IA locale sur Reddit.

Accélérations MoE dans llama.cpp. llama.cpp s'est doté d'un cache GPU pour les experts MoE résidant en mémoire hôte, promettant de gros gains de vitesse pour les modèles qui ne tiennent pas entièrement en VRAM, et prend en charge le MTP de GLM5Next.

Contrôles de dépôts dans Unsloth Studio. Unsloth Studio revérifie désormais les dépôts de modèles de confiance avant de les exécuter, après que des versions compromises de LiteLLM sur PyPI ont montré comment une attaque par la chaîne d'approvisionnement peut atteindre les outils d'IA.

GLM-5.3-Flash en bi-GPU. Une configuration à deux CMP 170HX de 64 Go fait tourner GLM-5.3-Flash avec 384 K de contexte à environ 90 tokens/s grâce à EXL3 ; le MoE de 320 B garde les poids actifs en HBM et se mesure à Qwen3.8-Flash-Next.

Benchmarks Qwen en local. De récentes évaluations communautaires comparent des fine-tunes de Qwen3.8-27B et Qwen3.8-Flash-Next à des modèles de frontière sur des tâches métier et de codage. Une éval de 469 questions conclut que les modèles locaux peuvent approcher les sorties de frontière, avec la confidentialité et un coût moindre, même si la surconsommation de thinking tokens reste un problème.

Matériel et Windows

Matériel IA Surface. Microsoft a annoncé le Surface Laptop Ultra et le Surface RTX Spark Dev Box, tous deux basés sur la puce RTX Spark de Nvidia, à architecture Arm. Le Laptop démarre à 2 599 $, avec jusqu'à 128 Go de mémoire unifiée, pour une sortie le 16 octobre ; le Dev Box démarre à 5 999 $ et vise l'exécution de modèles locaux de plus de 120 B.

Industrie et business

Le débogage, nouveau goulot. Une enquête menée auprès de 300 responsables techniques seniors constate que les agents de codage IA ont déplacé le goulot d'étranglement vers le débogage et la compréhension : les équipes passent désormais 9,8 heures par semaine à écrire du code, contre 16,9 heures à le déboguer. Le rapport pointe un risque croissant sur les bases de code critiques.

Cellule virtuelle : 1,8 Md$. Biohub coordonne un effort de 1,8 Md$ pour construire des modèles d'IA capables de prédire le comportement des cellules. Google DeepMind, Meta et Isomorphic Labs investissent 300 M$, et le DOE américain apporte plus de 500 M$ pour les mesures en laboratoire et le calcul.

Clones open source d'Adobe. Le développeur Brandon Thomas s'est servi de Claude Opus 5.5 pour créer Artcraft, une suite de sept applications open source en Rust/WebAssembly qui clonent Photoshop, Illustrator, Premiere et d'autres logiciels d'Adobe. Les applications n'en sont qu'à leurs débuts et présentent encore beaucoup de lacunes, mais le projet illustre la réimplémentation en salle blanche assistée par IA.

Détecteur SynthID public. Google ouvre au public son détecteur SynthID, qui permet à chacun de vérifier si des images, des vidéos ou des fichiers audio portent un filigrane de Google ou de ses partenaires. Le système a déjà marqué plus de 180 milliards de contenus et est aussi intégré à Chrome et Gemini.

Playground de Google. Google Labs lance Playground, une plateforme dans le navigateur où les adultes américains peuvent créer des jeux à partir de simples prompts, propulsée par Gemini, Nano Banana et Lyria. Unity a de son côté annoncé Unity Spark, dédié au développement de jeux professionnel assisté par IA.

C'est tout pour aujourd'hui - environ 5 minutes de lecture.

Lisez-le chaque matin, directement dans votre navigateur

L'extension ouvre ce digest dans le panneau latéral de Chrome — un clic, pas de compte.

Ajouter à Chrome — Gratuit