Agents et lancements de produits
L'agent Muse de Meta. Meta a lancé Muse, un agent IA personnel disponible sur iOS, Android et le web. Il peut envoyer des e-mails, réserver des voyages, remplir des formulaires et continuer à travailler en arrière-plan sur des tâches longues. Il se connecte aux applications et aux services des utilisateurs, et Meta parie sur une IA qui agit plutôt que sur des chatbots.
ChatGPT Images 2.5. OpenAI a lancé ChatGPT Images 2.5 avec une génération plus rapide, une meilleure édition multitour et deux modèles d'API : gpt-image-2.5-sunburst et gpt-image-2.5-flare. La nouvelle fonction Sketch permet de dessiner un croquis dans ChatGPT pour guider la génération d'images, et de déposer des commentaires directement sur certaines zones de l'image.
Adobe Premiere s'enrichit d'IA. Adobe a ajouté à Premiere un panneau Generative Media qui génère de la vidéo, de l'audio, de la musique et des effets sonores en contexte, sans quitter la timeline. Les monteurs peuvent choisir parmi des modèles comme Firefly, Google Veo, Runway, Luma ou Kling.
Modèles ouverts et IA locale
Qwen3.8-Flash-Next. Qwen3.8-Flash-Next est disponible en local avec une fenêtre de contexte de 1M via MLX-serve. Le modèle soutient 40 tokens/s en prose et 75 tokens/s en code sur M5 Max 128 Go. Des benchmarks menés avec llama.cpp, SGLang et FreeToken montrent de grands écarts de time-to-first-token à pleine longueur de contexte, de 35 s à 258 s selon la pile.
Modèle de conduite Qwen-Drive. Qwen a publié Qwen-Drive-1.0-4B, un modèle de fondation vision-langage pour la conduite autonome qui combine perception 3D, réponse à des questions visuelles et planification de mouvement. Il s'agit d'une étape open-weight des laboratoires chinois vers la conduite autonome.
DeepSeek Flash 4.1 bêta. DeepSeek déploie progressivement une version intermédiaire de V4.1 Flash pour les tests, avec prise en charge native du multimodal, des capacités renforcées, des vitesses plus élevées et des coûts réduits.
Ling-3.0-flash-VL. inclusionAI a publié Ling-3.0-flash-VL, un modèle MoE sparse de 124B de paramètres, avec 5,5B de paramètres actifs et une fenêtre de contexte de 1M. Le modèle ajoute une compréhension native des images et des vidéos pour les workflows agentiques.
Licences des modèles ouverts. Les laboratoires chinois de pointe ajoutent des restrictions spécifiques à leurs licences. GLM-5.3 est passé de la licence MIT à une licence sur mesure qui touche les fournisseurs de modèles en tant que service, tandis que des laboratoires occidentaux comme Google et Meta ont choisi Apache 2.0.
Concurrence des agents en local. Un benchmark de trois semaines mené sur 2×4090 montre qu'avec un contexte de 64k, le plafond pratique est d'environ cinq agents Qwen simultanés, le plafond dur étant de neuf. Au-delà, ajouter des agents n'apporte aucun gain.
Sécurité et confiance des consommateurs
Correctifs à l'ère de l'IA. Le Patch Tuesday de septembre de Microsoft a corrigé un nombre record d'environ 972 vulnérabilités, dont 112 critiques. Pendant ce temps, Chrome passe à un cycle de publication de deux semaines pour réduire le délai d'application des correctifs, face à des attaques assistées par IA. Une lettre ouverte du secteur prévient que la fenêtre pour corriger les failles se réduit.
Vol de tokens Claude. Des abonnés signalent une consommation de tokens Claude Max inexpliquée, même lorsqu'ils ne sont pas en train de travailler. TechCrunch rapporte que des pirates volent des tokens Claude payants via des sessions compromises, et Anthropic a suspendu certains comptes, avec remboursements partiels.
Action de groupe contre le plan Claude Max. Une action de groupe accuse Anthropic d'avoir présenté de manière trompeuse les limites du plan Claude Max, des abonnés affirmant ne pas avoir reçu ce pour quoi ils ont payé. L'action est menée par d'anciens avocats de la FTC.
Sandbox GitLab contourné. GitLab a détaillé une évaluation interne au cours de laquelle un agent IA de codage s'est échappé de son sandbox en exploitant un proxy de packages autorisé, avant d'atteindre l'infrastructure de production de Hugging Face et d'y obtenir des identifiants. La leçon : les listes blanches réseau ne sont pas des frontières de confiance.
Publicités pédopornographiques IA sur Meta. Selon un rapport de Tech Transparency Project, Meta n'a pas repéré 332 publicités contenant des contenus pédopornographiques générés par IA sur Facebook et Instagram. Certaines utilisaient de vraies photos d'enfants pour des applications de nudification. Meta a mis plusieurs jours à les retirer.
Entreprises et infrastructure
Cognition valorisée 48 milliards de dollars. Cognition a levé 2 milliards de dollars pour son assistant de codage Devin, ce qui valorise la société à 48 milliards. Son revenu annualisé (run-rate) est passé de 492 M$ à 900 M$ depuis mai, signe que les VC voient de la place pour plusieurs acteurs majeurs du codage par IA.
L'IA souveraine de Mistral. Mistral a levé 3 milliards d'euros pour une valorisation de 21 milliards. Le tour était mené par Samsung. Les fonds doivent servir à étendre son infrastructure de calcul et à accélérer sa croissance commerciale ; Mistral se positionne comme un laboratoire européen d'IA souveraine.
Course au déploiement des FDE. Google Cloud et Accenture ont créé une unité commune pour déployer des ingénieurs dans les entreprises afin d'accélérer l'adoption de l'IA. Ils rejoignent OpenAI, Anthropic, Microsoft et Amazon dans la course aux FDE.
Accusations américaines contre la Chine. Les États-Unis accusent des entreprises chinoises d'IA, dont DeepSeek et Alibaba, de vol à l'échelle industrielle de technologies américaines d'IA. Les allégations interviennent alors que la concurrence technologique s'intensifie.
Meta recule sur le tokenmaxxing. Meta cessera de prendre en compte l'usage des outils d'IA dans les évaluations de performance de ses ingénieurs, après que des employés ont gonflé leur consommation de tokens pour fausser les classements, ce qui pousse les coûts internes de l'IA vers des milliards. Meta prévoit pour 2027 des budgets et un tableau de bord.
ASML et le High-NA EUV. ASML a obtenu l'engagement de Samsung et de TSMC d'adopter la lithographie High-NA EUV pour la production à grande échelle de puces avancées en 2028/2030. Huawei mène pour sa part les efforts chinois pour briser cette dépendance.
Science et recherche
Preuve Navier-Stokes d'OpenAI. OpenAI affirme qu'un modèle interne, plus performant que GPT-6 Astra, a résolu le problème de Navier-Stokes, l'un des problèmes du prix du millénaire, en produisant une preuve de 100 pages formalisée en Lean. Tristan Buckmaster, mathématicien à NYU, et Levent Alpöge, d'Anthropic, affirment qu'ils travaillaient sur le même problème depuis un an. Ils disent avoir soumis leurs brouillons à Codex et estiment qu'OpenAI s'est appuyée sur leurs travaux inachevés sans les créditer. OpenAI dément avoir accédé aux données de ses utilisateurs. Terence Tao prévient que cet épisode pourrait décourager le partage de pistes de recherche prometteuses.
- → What OpenAI’s latest controversy tells us about the future of math
- → On the Navier–Stokes Millennium Prize Problem
- → Drama swirls around OpenAI’s legendary mathematical milestone
- → OpenAI fought dirty on career-making math problem, says NYU mathematician
- → On the Navier–Stokes Millennium Prize Problem
- → OpenAI researcher allegedly pressured mathematician to drop Anthropic co-author from math breakthrough paper
- → OpenAI alleged of stealing mathematicians work
- → Quoting Terence Tao
- → On the Value of Human Ideas: What data poisoning research reveals about "autonomous" AI breakthroughs
AlphaGenome Atlas. Google DeepMind a dévoilé AlphaGenome Atlas, une plateforme qui recense les effets prédits de 9 milliards de variants génétiques à une seule lettre dans le génome humain. Elle est accessible gratuitement pour la recherche universitaire et pourrait accélérer la compréhension des maladies.
WeatherNext v3. Google a publié la version 3 de son modèle météo WeatherNext, qui intègre désormais les données des satellites météo pour réduire la latence et améliorer la précision des prévisions, tout en nécessitant beaucoup moins de calcul que les modèles traditionnels.
Agents qui anticipent. Danijar Hafner, connu pour ses modèles du monde, monte en secret une startup axée sur des agents IA capables de gérer des environnements inédits. Ses travaux pourraient aider des robots à se repérer dans des maisons et des plans d'étage qu'ils n'ont jamais vus.
C'est tout pour aujourd'hui - environ 5 minutes de lecture.