Agentic AI News Aujourd'hui

Les actualités du jour sur les agents IA en une lecture de 5 minutes : lancements, outils, recherches, financements et mouvements d'entreprise.

Mis à jour quotidiennement sélectionné à partir de 30 sources jeudi, août 20, 2026

Sorties de modèles ouverts et locaux

Famille ouverte Ornith-1.5. Ornith-1.5 publié en versions 9B dense, 35B MoE et 397B MoE sous licence MIT avec de solides benchmarks d'agents et de codage ; les quantifications de la communauté montrent que la 35B tourne à 60 tk/s sur une 4070 Ti 12 Go et que la 9B surpasse les anciens petits modèles.

Rapports de terrain sur Qwen3.8-27B. Les utilisateurs locaux rapportent que Qwen3.8-27B peut exécuter de manière autonome plus de 80 appels d'outils et gérer de longues chaînes d'agents, mais ses connaissances hors ligne et ses scores de codage stricts sont plus faibles que ceux de ses prédécesseurs, il fonctionne donc mieux avec une direction claire ou un copilote.

Accélérations et quantifications de Qwen3.8. Les efforts de la communauté ont poussé Qwen3.8-27B à 138 tps sur une RTX 3090 avec DFlash2, publié des quantifications Dynamic V3 revendiquant une précision supérieure de 10 %, un Mini-Me 22.7B élagué en profondeur, et du FP4 natif sur des V100 de 2017 égalant une 5090.

Points de contrôle de base Ling. AntLing a open-sourcé les points de contrôle de base et de mi-entraînement pour Ling-3.0-tiny et flash sans post-entraînement, et un utilisateur associe Ling tiny comme auxiliaire pour la compression de contexte aux côtés de Qwen3.8.

Quantifications LFM2.5 QAD. Liquid AI a publié des points de contrôle Q4_0 entraînés avec distillation consciente de la quantification, récupérant 97 % de la précision BF16 avec la même vitesse et la même mémoire.

GLM-5.3 et sorties frontières. GLM-5.3 se classe au même niveau que Kimi K3 en tête des classements de modèles ouverts avec de grands gains en matière d'agents et un coût inférieur, bien que les poids ouverts soient retardés de deux semaines ; DeepSeek V4-Pro GA et NVIDIA Nemotron 3.5 Lightning/NeMo Switchyard ont également été livrés.

Outils d'agent et mises à jour de produits

Sandbox sécurisées. Simon Willison a testé smolmachines/smolvm comme sandbox pour du Python et JavaScript non fiables avec des limites de CPU/RAM et sans réseau ; Jeremy Morrell soutient que les extensions écrites par LLM plus les primitives de sandbox permettent des logiciels extensibles sûrs.

Mode gratuit Replit. Replit a introduit le mode gratuit propulsé par GPT-5.6 Luna, permettant à quiconque de créer des applications et des agents sans contraintes de coût de tokens.

Notes IA de Calendly. Calendly est entré dans la prise de notes de réunion avec des résumés, des éléments d'action et un assistant Callie à venir qui utilise le contexte de la réunion pour planifier des suivis.

Application Mac Meta AI. Meta a lancé une application Mac pour son chatbot IA avec partage d'écran, dictée et intégration Google Workspace pour concurrencer les assistants de bureau Gemini, ChatGPT et Claude.

Détection d'arnaque sur appareil WhatsApp. WhatsApp teste Scam Alert, un modèle sur appareil facultatif qui classe les messages provenant de non-contacts tout en utilisant des analyses fédérées confidentielles pour préserver la confidentialité.

Outils d'étude Google. Google a déployé un hub étudiant Gemini, des visuels interactifs et des quiz générés par IA dans Search, et Deep Research dans Gemini Live pour la rentrée.

Alexa+ gratuit sur Fire TV. Amazon a rendu Alexa+ gratuit sur Fire TV sans Prime, déployant automatiquement la recherche conversationnelle, les contrôles de maison intelligente et les recommandations IA.

Industrie et affaires

Stripe achète OpenRouter. Stripe a confirmé l'acquisition d'OpenRouter pour 7,5 milliards de dollars, et les fondateurs ont cité la « singularité » comme raison de rester privé et d'investir dans l'infrastructure d'agents.

Rapport SpaceX-Cognition démenti. Bloomberg a rapporté que SpaceX a tenté d'acquérir Cognition, mais le PDG Scott Wu a démenti l'information, affirmant que Cognition n'est pas à vendre et qu'aucune discussion n'a eu lieu.

Anthropic en tête des revenus. Anthropic a dépassé OpenAI pour la première fois en termes de revenus trimestriels, atteignant 11,6 milliards de dollars avec un petit bénéfice d'exploitation, tandis que les 6,7 milliards de dollars d'OpenAI sont arrivés avec des pertes plus importantes.

La puissance de calcul comme classe d'actifs. Nvidia travaille avec Apollo, BlackRock et d'autres sur un financement de 500 milliards de dollars pour traiter la puissance de calcul comme un actif investissable ; Silicon Data a levé 30 millions de dollars pour lancer des contrats à terme CME sur GPU.

Mémoire et approvisionnement en puces. Les prix de la DRAM ont augmenté de 500 % en 12 mois et les hyperscalers ont verrouillé l'approvisionnement pour 2027 ; la Chine autorise de petits lots de H200 à ByteDance et Tencent pour faciliter la capacité d'inférence.

Infrastructure de centres de données. TerraPower prévoit un projet de centre de données utilisant le stockage d'énergie de son réacteur Natrium, tandis que Relativity Networks a levé 22 millions de dollars pour une fibre à cœur creux qui transmet les données 50 % plus rapidement.

La réputation de l'IA se dégrade. Pew a constaté que 52 % des Américains sont plus inquiets qu'enthousiastes à propos de l'IA, et les accords locaux de centres de données font face à une opposition publique.

Sécurité, confidentialité et sûreté

Private Safety Processing d'OpenAI. OpenAI a présenté en avant-première Private Safety Processing pour les clients à zéro conservation de données, permettant la détection d'abus à travers les interactions sans exposer le contenu au personnel ; cela contraste avec la politique de conservation de 30 jours d'Anthropic.

OpenAI corrige Codex et TAC. OpenAI a publié des mesures de protection après que Codex a supprimé de vrais fichiers d'utilisateurs via des commandes de nettoyage défectueuses, et a confirmé qu'une erreur distincte a brièvement révoqué l'accès à son programme Trusted Access for Cyber.

Exploits ICS générés par IA. Les agences américaines ont averti que des attaquants utilisent l'IA pour créer des scripts d'exploitation Siemens S7, réduisant les compétences et le temps nécessaires pour attaquer les systèmes de contrôle industriels.

Contrôles internes des laboratoires d'IA. La première évaluation de Guidelight a constaté qu'aucune entreprise d'IA n'applique pleinement les contrôles internes de base ; Anthropic et OpenAI sont en tête avec C+, tandis que xAI et Meta obtiennent D- et F.

Publicités deepfake de Meta. Meta a diffusé des publicités pour une application de nudification IA ciblant des femmes politiques malgré des politiques interdisant le matériel sexuel.

Vente de données des employés de Spirit. Google a remporté une enchère pour les données d'emploi de Spirit Airlines ; d'anciens agents de bord objectent que la confidentialité des travailleurs pourrait ne pas être protégée contre la ré-identification.

OpenAI ralentit le développement. OpenAI a interrompu certains entraînements RL et retardé des exécutions frontières tout en renforçant les mesures de protection, testant si un ralentissement volontaire peut fonctionner sans adoption à l'échelle de l'industrie.

Recherche et analyse

Conception de protéines Claude. Les modèles Claude d'Anthropic ont conçu des minibinders sur 15 cibles avec un taux de réussite de 26,8 %, surpassant les résultats typiques de découverte de médicaments en phase précoce, bien qu'un examen indépendant soit en attente.

Données tissulaires Vivodyne. Les laboratoires robotisés HIVE de Vivodyne cultivent 20 types de tissus humains et génèrent des données biologiques causales pour répondre à ce qu'ils considèrent comme le problème de données manquantes de la découverte de médicaments par IA.

Mythe des jetons de raisonnement. La recherche remet en cause l'idée que les jetons intermédiaires des LLM sont un raisonnement sémantiquement significatif ; les modèles produisent souvent des traces invalides même avec des réponses correctes, et l'entraînement sur des traces corrompues peut encore fonctionner.

Métrique de productivité en codage. Simon Willison soutient que les lignes de code de production débogué restent une métrique de productivité significative avec les agents de codage, mais atteindre ce résultat nécessite toujours des compétences d'ingénierie senior.

C'est tout pour aujourd'hui - environ 5 minutes de lecture.

Lisez-le chaque matin, directement dans votre navigateur

L'extension ouvre ce digest dans le panneau latéral de Chrome — un clic, pas de compte.

Ajouter à Chrome — Gratuit