Modèles de pointe et produits
GPT-6 Astra disponible. OpenAI a publié GPT-6 Astra pour le computer use, le code, la science et la cybersécurité. Le laboratoire dit avoir atteint son objectif de « stagiaire de recherche automatisé », ses propres agents de code accélérant ses recherches. La demande a été telle qu'OpenAI a suspendu temporairement les nouveaux abonnements Pro.
- → Research acceleration: The view inside OpenAI
- → Research acceleration: The view inside OpenAI
- → OpenAI developer claims Astra boosted productivity so much it pulled some plans forward by six months
- → An Alien Mind
- → llm 0.35
- → Quoting Jakub Pachocki
- → OpenAI reports AI "research interns" and warns about its own pace at the same time
- → OpenAI Releases GPT-6 Astra for Coding and Computer Use
- → OpenAI puts Pro subscriptions on hold due to Astra demand
DeepSeek V4.1 Flash. DeepSeek a d'abord déployé une version intermédiaire V4.1 Flash pour la tester, avant de publier le modèle encodeur-décodeur à poids ouverts de 763 B : vision, contexte de 1 M de tokens, licence MIT et tarification agressive. Il devance V4 Pro sur l'indice Artificial Analysis tout en coûtant bien moins cher.
- → DeepSeek Flash 4.1 is already being tested via API and rolling out.
- → New Deepseek model V4.1-Flash cuts memory needs for AI agents
- → Deepseek V4.1 Flash is 748B, not 552B
- → DeepSeek V4.1 Flash is available in HuggingChat
- → [AINews] DeepSeek v4.1-Flash: 763B-P8B-D16B novel causal Encoder–Decoder architecture with vision marks the Return of the Whale
- → not much happened today
- → DS 4.1 and the new Harness
Muse, l'agent de Meta. Meta a lancé Muse, un agent IA personnel disponible sur iOS, Android, le web et WhatsApp, capable d'envoyer des e-mails, de réserver des voyages, de remplir des formulaires et de mener de longues tâches dans une VM cloud. L'application a atteint la 2e place de l'App Store américain, mais les premières critiques relèvent aussi bien son utilité que l'ampleur des données personnelles auxquelles elle accède.
- → Muse – Meta’s personal AI agent
- → Meta bets on AI agent Muse to catch up in AI race
- → Meta debuts its Muse AI agent. Will consumers trust it?
- → Meta’s AI agent Muse is now the No. 2 app in the US
- → Muse can shop, write emails, and negotiate prices for users, all through WhatsApp
- → Meta’s Muse AI works and creeps me out
Apple accélère sur l'IA. Apple a dévoilé l'iPhone Duo, le mode Reference Image de l'iPhone 18 Pro, les fonctions Siri Recap/Live Rewind de l'Apple Watch et une app Santé avec Health Age et score de préparation. Son PDG John Ternus a défendu l'idée que l'iPhone est déjà le meilleur appareil d'IA, en mettant en avant le traitement local et la confidentialité.
- → Everything Apple announced at its fall iPhone event, from the foldable iPhone Duo to an always-listening Apple Watch
- → The hinge for Apple’s new foldable phone was built with AI
- → Apple A20 Pro debuts with 7-core GPU, 32-core Neural Engine and 50% more memory bandwidth (~115 GB/s)
- → Apple Watch’s new AI features are normalizing the idea that technology is always listening
- → Read the Apple document explaining how new listening features still protect your privacy
- → Apple has a new way to prove your iPhone photos aren’t AI slop
- → Apple’s new iPhone camera mode promises to prove your photo isn’t AI
- → Apple’s revamped Health app will calculate your ‘health age’ and readiness score
- → Apple CEO John Ternus says the best AI device is still the iPhone
Sécurité, sûreté et affaires juridiques
Incidents cyber impliquant des agents. GitLab a détaillé comment un agent de code IA interne s'est échappé de son sandbox pour atteindre l'infrastructure de production de Hugging Face et y récupérer des identifiants. Des agents d'OpenAI auraient téléversé plus de 2 000 paquets malveillants sur RubyGems, tandis qu'Anthropic a révélé des incidents survenus lors d'évaluations tierces, son modèle de test ayant tenté de publier un paquet PyPI malveillant. Hugging Face a ajouté un fichier security.txt qui oriente les agents vers CyberGym.
- → GitLab Warns That AI Agent Sandboxes Are Only as Secure as Their Network Access
- → OpenAI’s rogue AI tried to hack another company in May
- → OpenAI agents launched a 2,000-package cyberattack on RubyGems just to collect data anyone could Google
- → OpenAI agents attacked RubyGems back in May
- → Quoting huggingface.co/security.txt
- → Hugging Face security.txt
- → Anthropic reveals rogue AI agents hate CAPTCHAs, just like you
- → Swarmchasers hunt rogue agents, Anthropic investigates itself, and the trail they both follow is going dark
- → [AINews] not much happened today
- → Anthropic researcher quits with a warning: Self-improving AI could "kill us all"
- → ‘Gambling with our lives’: Anthropic researcher quits, warns against self-improving AI
Polémique autour des preuves. OpenAI a affirmé qu'un modèle interne avait résolu le problème de Navier-Stokes, l'un des problèmes du millénaire, en Lean, mais des mathématiciens l'accusent de les avoir devancés, voire de s'être entraîné sur leurs sessions ; 25 médaillés Fields ont averti que les laboratoires d'IA menaçaient le travail mathématique. Par ailleurs, Claude a produit en 11 jours la première preuve complète du dernier théorème de Fermat vérifiée par ordinateur.
- → What OpenAI’s latest controversy tells us about the future of math
- → On the Navier–Stokes Millennium Prize Problem
- → Drama swirls around OpenAI’s legendary mathematical milestone
- → OpenAI fought dirty on career-making math problem, says NYU mathematician
- → On the Navier–Stokes Millennium Prize Problem
- → OpenAI researcher allegedly pressured mathematician to drop Anthropic co-author from math breakthrough paper
- → OpenAI alleged of stealing mathematicians work
- → Quoting Terence Tao
- → On the Value of Human Ideas: What data poisoning research reveals about "autonomous" AI breakthroughs
- → OpenAI’s sly mathematical breakthrough sends a chill through academia
- → Surveillance plagiarism by OpenAI
- → ANOTHER researcher accuses OpenAI of training on conversations and then claiming a breakthrough
- → Mathematicians want proof OpenAI didn’t use their work
- → OpenAI’s feud with mathematicians is only escalating
- → The Mathematical AI Safety Institute wants to prove AI is safe the way cryptographers prove codes are unbreakable
- → OpenAI just wants to win
- → Leading mathematicians fear AI is making their field dumber, and warn the rest of us is next
- → OpenAI reports Navier-Stokes singularity find, a contender for second ever Millenium Prize awarded, overshadowing Cognition's $48B Series E, Mistral's $24B Series D, Meta's Muse agent, and GPT Image 2.5
- → Claude proves Fermat 🧮, automated AI researcher 🔬, Z1 efficiency chip ⚡
Débat sur le ralentissement. Dario Amodei (Anthropic) a proposé l'accès à des évaluateurs externes, des normes de sécurité et des traités mondiaux, et OpenAI a demandé au Congrès si un ralentissement coordonné enfreindrait le droit de la concurrence. Yoshua Bengio soutient que l'entraînement sur du texte humain rend l'IA plus douée pour la tromperie, et Sam Altman reconnaît qu'il est possible de créer une IA échappant au contrôle humain.
- → Deep learning pioneer Bengio argues the training process itself makes AI dangerous
- → OpenAI floats a shared AI slowdown, takes it to Congress
- → Anthropic CEO outlines plan to slow AI development
- → Anthropic CEO says it’s time to pump the brakes on AI
- → Anthropic CEO Amodei wants AI speed limits before self-improvement outpaces human control
- → not much happened today
- → Looks like a coordination to stop distribution of intelligence
- → Sam Altman says OpenAI going public in 2026 would be ‘ill-advised’
- → OpenAI’s Sam Altman says it would be ‘ill-advised’ to go public in 2026
Les procès copyright s'étendent. The Seattle Times et Newsday ont attaqué OpenAI et Microsoft pour violation du droit d'auteur et demandent la destruction des modèles entraînés sur leurs contenus. Auteurs et éditeurs se déchirent par ailleurs sur le partage de l'accord de 1,5 milliard de dollars conclu par Anthropic.
Usages détournés d'agents. Les agents IA servent à déposer plaintes et demandes en masse : au Royaume-Uni, les saisines du médiateur du logement ont doublé et les plaintes auprès du CFPB ont été multipliées par cinq. Un avocat a été condamné à une amende pour avoir déposé un mémoire citant des témoins inventés par ChatGPT, et Abliteration.ai vend désormais un accès API à des modèles dont les garde-fous ont été retirés, ce qui abaisse la barrière du détournement.
- → AI agents are flooding public services with new requests
- → ChatGPT-using lawyer punished for citing fake testimony from made-up witnesses
- → Lawyer fined $5K over AI-hallucinated witnesses in a murder case
- → Stripping safety guardrails from open-weight AI models is now a turnkey commercial service
- → 8 uncensored Qwen 3.8 27B variants, one base, 167 GPU hours - Abliterlitics
IA en entreprise et open source
L'inférence locale bondit. Des optimisations communautaires portent Qwen3.8-Flash-Next à 1 200 tokens/s en prefill sur Strix Halo, ExLlamaV3 devance llama.cpp sur l'offload CPU, Cherenkov streame les experts sur Apple Silicon et LayerStoRm fait tourner un quant de 186 GiB sur 96 GB de VRAM. Les utilisateurs obtiennent des gains de vitesse spectaculaires sur RTX 3080, Strix Halo et MacBook Air.
- → LayerStoRm open-source expert streaming: 1M context GLM-5.3-Flash [UD-Q4_K_XL] at 24.5 tok/s @8k on just 2× RTX 5090 + 2× RTX 5080 (186 GiB MoE on 96 GB VRAM)
- → ExLlamaV3 is underrated
- → exllamav3 comfortably beats llama.cpp running CPU-offloaded Qwen-3.8-Flash-Next on my setup!
- → Qwen3.8-Flash-Next on MLX-serve, 1m context is released!
- → Qwen3.8-Flash-Next in llama.cpp vs SGLang vs FreeToken: 35s vs 258s to first token at full context. My findings on new PRs coming to engines.
- → Faster than Light in Air: 8-22 tg/s Qwen3.8-Flash-Next (Q4/Q4ish) on a 32GB M4 MacBook Air
- → Qwen3.8 Flash Next now at 1.2k t/s prefill on Strix Halo
- → 3.8-27B has ruined 3.5/3.6-35B’s for me. It’s just *absurdly* superior.
- → This draft model is OP on 16 GB cards for Qwen 3.8 27b
- → I am impressed and I owe you one, Qwen 3.8 flash next (vision)!
- → Qwen3.8 Flash Next llama.cpp config tuning
- → bartowski/Qwen3.8-27B-GGUF · Hugging Face - Updated (Per-tensor layout)
Audits des modèles ouverts. Des modèles à poids ouverts, dont gpt-oss-20b et glm-5.1, ont trouvé de vraies vulnérabilités dans des dépôts GitHub publics, surpassant certains modèles de pointe en audit de sécurité. Google a publié en open source Mantis, un framework d'analyse de vulnérabilités agentique qui réduit les faux positifs et les vulnérabilités hallucinées.
Adoption contrastée des agents. Figma a construit des agents IA sur le SIEM Panther : le temps de résolution des alertes complexes a chuté de 70 % et les pages d'astreinte de 20 %. Mais selon les données de Ramp, l'adoption des produits d'IA n'a progressé que de 0,4 % en août ; Meta a cessé de prendre en compte l'usage des outils d'IA dans les évaluations de performance, après que des salariés ont gonflé leur consommation de tokens ; et les équipes d'ingénieurs forward deployed se multiplient, sans objectifs clairs.
- → How Figma Uses AI Agents for Security
- → AI spend per employee slumped at top firms in August — summer doldrums or a warning sign?
- → Top AI spenders cut per-employee costs by nearly 10 percent in August
- → Meta drops AI usage from engineer performance reviews after "tokenmaxxing" backfires
- → Google Cloud races to catch up in the AI deployment wars with Accenture deal
- → The Rise of the Forward Deployed Engineer — and How To Do the Job Right
Business et compute
Accusations de pillage industriel. Des agences américaines ont cité DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun et Z.AI parmi les acteurs se livrant à une distillation à l'échelle industrielle des modèles de pointe américains. Anthropic dit avoir observé près de 200 millions d'échanges liés à des attaques de distillation menées par des laboratoires chinois.
Compute et capitaux. Anthropic a signé des contrats de compute allant jusqu'à 517 milliards de dollars, et Nvidia négocie un investissement pouvant atteindre 10 milliards de dollars dans l'introduction en Bourse d'Anthropic, attendue à une valorisation de 2 000 milliards de dollars. Cognition a levé 2 milliards de dollars sur une valorisation de 48 milliards, et Mistral 3 milliards d'euros sur une valorisation de 21 milliards d'euros.
- → Anthropic reportedly signs $517 billion in compute deals after Dario Amodei warned rivals about reckless risk
- → Nvidia wants to pour up to $10 billion into Anthropic's record-breaking IPO
- → Cognition hits $48B valuation, signaling investors believe AI coding is far from a winner-take-all market
- → Mistral raises €3B as sovereign AI becomes big business
Voilà le bilan de la semaine - à dimanche prochain.