Sécurité et politique
Incidents cyber chez Anthropic. Anthropic a révélé quatre incidents de cybersécurité survenus lors d'évaluations tierces menées avec les garde-fous désactivés, et METR va enquêter. Le chercheur Jacob Coxon a démissionné en avertissant qu'une IA capable de s'améliorer seule pourrait tous nous tuer ; Evan Hubinger, d'Anthropic, a jugé ce risque supérieur à 10 %.
Christiano entre au conseil d'OpenAI. Paul Christiano a rejoint le conseil de la fondation OpenAI comme observateur sans droit de vote, et siégera à son comité Sûreté et sécurité. OpenAI a aussi présenté ses priorités en matière de politique publique, dont des règles nationales obligatoires sur la sécurité de l'IA et son soutien à quatre propositions de loi californiennes.
Polémique sur le prix du Millénaire. OpenAI a annoncé avoir résolu un problème du prix du Millénaire, mais des mathématiciens affirment avoir été devancés et accusent l'entreprise d'espionnage et d'entraînement de modèles sur les sessions de chercheurs. La polémique fait craindre un effet dissuasif sur la collaboration académique.
Washington accuse six entreprises. La NSA, la CISA et le FBI ont cité DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun et Z.AI parmi les entreprises se livrant à une distillation à l'échelle industrielle des modèles frontières américains depuis fin 2024. Les agences appellent à une action coordonnée pour mettre fin à ce vol présumé.
Un ver zero-click généré par IA. Calif Research a publié une démo de WeWorm, un ver « zero-click » qui se propage via les appels WeChat : selon l'entreprise, l'IA a aidé à trouver la faille et à écrire l'exploit en deux jours environ.
Industrie et entreprises
Tour de table avorté chez Listen Labs. Listen Labs s'est retiré d'une lettre d'intention de série C déjà signée, portant sur 125 millions de dollars et une valorisation de 1,5 milliard de dollars, en pleine discussions de rachat avec Salesforce, qui aurait envisagé d'acquérir la start-up pour environ 2 milliards de dollars.
Dépenses IA par salarié. Les données de Ramp, tirées de 70 000 entreprises, montrent que l'adoption des produits d'IA n'a progressé que de 0,4 % en août, et que 56 % des clients paient pour des outils d'IA. Ce ralentissement est peut-être saisonnier, mais il accentue la pression sur les investissements en infrastructures.
Cymphony lève 30 M$. Sequoia a co-dirigé une série A de 25 millions de dollars dans Cymphony, qui développe un graphe des effectifs pour suivre les accès des agents IA et des identités non humaines aux systèmes d'entreprise.
Des adresses e-mail pour Instinct. L'assistant IA viral Instinct attribue à chaque utilisateur une adresse e-mail Instinct, pour que l'agent puisse créer des comptes, contacter des entreprises et gérer les inscriptions sans encombrer les boîtes personnelles.
Assistants IA chez Instacart et Shipt. Instacart a lancé Clementine et Shipt, Ask Shipt : deux assistants d'achat conversationnels qui transforment un prompt en panier prêt à valider. Les applications de livraison rivalisent pour devenir des outils de planification.
Sorties de modèles et recherche
Suno v6, avec les labels. Suno a publié les modèles musicaux v6, v6-wild et v6-mini, entraînés sur des données sous licence de Warner, BMG et Believe. Les nouveaux modèles sont plus rapides, mais butent encore sur les imperfections naturelles.
Les 9 milliards de variants d'ADN. AlphaGenome Atlas, de Google DeepMind, prédit les effets de l'ensemble des quelque 9 milliards de modifications ponctuelles possibles de l'ADN, dans des centaines de types de cellules, et produit un jeu de données d'un pétaoctet.
Un modèle IBM pour séries temporelles. IBM a publié Granite Time Series PatchTST-FM-r2, un modèle de fondation d'environ 385 millions de paramètres pour la prévision et l'imputation zero-shot, actuellement en tête des modèles zero-shot ouverts sur GIFT-Eval.
Les agents organisationnels de Meta. Meta a décrit l'architecture d'un agent « second cerveau organisationnel », qui capture l'expertise métier via un système de connaissances, un pipeline de raisonnement, un cadre d'évaluation et une boucle d'auto-amélioration.
Modèles locaux et optimisation
Performances de Qwen3.8. Des retours de la communauté font état, pour Qwen3.8-Flash-Next, d'accélérations du prefill de 2,2 à 2,5× en déportant le cache des experts pendant les prompts, de 10 à 20 t/s sur une RTX 3060, et d'un utilisateur qui a réussi un entretien de programmation face à GLM.
GLM 5.3 Flash optimisé. Un quant optimisé de GLM-5.3-Flash atteint 38 à 60 t/s sur M3 Ultra, en fusionnant les kernels et en portant l'utilisation de la bande passante mémoire à 81 % de son plafond.
Bonsai-27B dans le navigateur. mentria.ai fait tourner un modèle 27B nativement en 1 bit à 25 à 30 tok/s sur un portable équipé d'une RTX 3060 de 6 Go, via WebGPU, sans installation ni serveur.
Le bug du focus sous Windows. Sous Windows, l'inférence LLM était 2 à 3 fois plus lente lorsque la fenêtre du serveur n'avait pas le focus, à cause de délais d'ordonnancement CPU ; lancer le processus en mode détaché ou headless corrige le problème et maintient le débit à 130 à 200 tok/s.
Outils et frameworks
Des identifiants pour Managed Deep Agents. Connections, de LangChain, fournit une identité par appelant, limitée à l'espace de travail, pour les Managed Deep Agents : les identifiants sortent du code et l'autorisation reste aux mains de l'utilisateur.
Changer de modèle d'embedding. embedflow permet de migrer entre modèles d'embedding sans recalculer les embeddings de tout le corpus : il reclasse les top-K documents avec le nouveau modèle. Testé sur jusqu'à 1 million de documents.
Des balises d'émotion pour la TTS. Un modèle Qwen3-TTS affiné ajoute des balises d'émotion inline, entraîné sur 74 000 extraits et neuf voix, ce qui améliore le contrôle de la parole générée.
Un modèle de fondation text-to-synth. Foundation-1, un modèle audio indépendant, génère des one-shots à l'infini et des synthés jouables à partir d'un prompt texte ; le pipeline d'entraînement et d'inférence est publié.
Événement IA d'Apple et vie privée
iPhone Duo pliable et puce A20. Apple a dévoilé l'iPhone Duo, son premier pliable, doté d'une charnière conçue à l'aide d'algorithmes d'IA et de micro-couches imprimées en 3D. La nouvelle puce A20 Pro embarque un Neural Engine à 32 cœurs et 50 % de bande passante mémoire en plus.
Écoute ambiante sur Apple Watch. Les nouvelles fonctions IA de l'Apple Watch, comme Siri Recap et Live Rewind, traitent l'audio en direct ; Apple assure que l'audio brut est traité dans une Secure Exclave, inaccessible au système d'exploitation comme à Apple. Des critiques y voient une banalisation de l'écoute permanente.
L'authenticité en mode Reference Image. Le mode Reference Image de l'iPhone 18 Pro s'appuie sur des données de capteur signées et sur Private Cloud Compute pour produire une image non modifiable, et ainsi prouver qu'une photo n'a pas été manipulée par IA.
Âge santé et score de forme. L'app Santé repensée d'Apple utilise Apple Intelligence pour calculer un âge santé, un score de forme et des conseils personnalisés, avec un bilan biologique optionnel proposé par Quest.
L'iPhone comme hub IA. Le PDG d'Apple, John Ternus, a affirmé que l'iPhone est déjà le meilleur appareil d'IA, en mettant en avant la confidentialité, le traitement sur l'appareil et le contexte.
C'est tout pour aujourd'hui - environ 5 minutes de lecture.