Sorties de modèles et benchmarks
Gemini 3.8 Flash. Google a lancé son troisième modèle Flash en six semaines, avec un meilleur raisonnement, de meilleures capacités de codage et une meilleure utilisation agentique des outils. Le prix par token reste inchangé, mais le modèle peut consommer davantage de tokens. Une variante Cyber est disponible pour les défenseurs de confiance via le nouveau programme Fairwind.
- → Google releases Gemini 3.8 Flash, its third Flash model in six weeks
- → Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
- → Proactive cyber defense for governments and enterprises
- → Proactive cyber defense for governments and enterprises
- → Gemini 3.8 Flash is Google's third budget model in six weeks while frontier models remain MIA
- → Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost more
- → llm-gemini 0.34
Muse Spark 1.3. Le modèle à poids ouverts de Meta se classe désormais troisième au classement AAII, à égalité avec GPT-5.6-Sol, et offre un entraînement plus de 90 % moins cher si les utilisateurs y adhèrent. Les poids ouverts sont promis, et les utilisateurs attendent des variantes plus petites, entre Glimmer et Spark.
GLM-5.3 vs DeepSeek-V4. Les comparatifs de la communauté menés sur Mac Studio et DGX Spark montrent que GLM 5.3 Flash produit plus vite des conclusions et se montre meilleur en écriture et en vision, tandis que DeepSeek V4 Flash offre plus de tokens par seconde et un contexte plus long. La prise en charge de la vision et les GGUFs sont désormais disponibles pour DeepSeek-V4-Flash-Vision-Exp.
IA locale et open source
Réglage de Qwen3.8 Flash Next. La PR sur le cache d'experts fait passer le décodage de 17 t/s à 25-29 t/s sur deux 3090, et les nouveaux quants AP et le Q8 N-gram bolting n'entraînent aucune perte de vitesse. Des utilisateurs signalent aussi des hallucinations de plan et une corruption du contexte, ce qui suggère une qualité de version préliminaire.
Perplexity Lily. Perplexity a publié en open source son serveur d'inférence pour Mac, optimisé pour Qwen 3.6 sur Apple Silicon, en mettant l'accent sur un modèle unique pour des performances optimales.
Outils vocaux locaux. VoxGen apporte une synthèse vocale Rust/Vulkan pour VoxCPM2, avec des performances AMD fluides. Microsoft a publié VibeVoice ASR en streaming, et des utilisateurs présentent Mac Parakeet et Whisper/Parakeet comme configuration STT fonctionnelle pour le codage.
Mod Minecraft généré par GLM. Un GLM 5.3 Flash Q4 local, tournant sur quatre RTX PRO 6000, a construit de manière itérative un mod de fusil à trou noir pour Minecraft avec la Fabric API.
Recherche et modèles du monde
World Labs Atlas. World Labs a dévoilé Atlas, un modèle unique qui génère, reconstruit et simule des scènes 3D à partir de quelques photos, en utilisant le contexte spatial pour ancrer chaque entrée dans l'espace 3D.
Contrôle par le langage de H3-World. H3-World transforme des actions de personnage et de caméra en instructions textuelles injectées par la branche textuelle de MiniMax-H3, ce qui permet de contrôler les mouvements du jeu avec seulement 8 000 échantillons et 0,199 % de paramètres entraînables.
Sécurité, réglementation et droit
Astra : craintes sur la sécurité. Le futur modèle Astra d'OpenAI utilise une récurrence opaque, ce qui complique le suivi de sa chaîne de raisonnement. Ses capacités cyber sont jugées « critiques », et les experts en sécurité redoutent une course au laxisme.
Le DOJ soutient le fair use. Le gouvernement américain s'est rangé du côté d'OpenAI dans le procès intenté par le New York Times, estimant que l'entraînement des LLM sur des textes protégés par le droit d'auteur relève du fair use et se distingue des sorties, afin de préserver le leadership américain en IA.
Cadre secret de sécurité de l'IA. Une action en justice vise à obliger l'administration Trump à révéler son cadre secret d'examen de la sécurité des IA de pointe avant leur publication, un cadre qui ne fait l'objet d'aucune transparence publique ni de contrôle du Congrès.
Interdiction de l'IA pour les élèves à New York. La ville de New York a interdit l'IA aux élèves jusqu'à la quatrième et les chatbots de compagnie à tous les niveaux, avec un usage limité au lycée et des cours d'initiation à l'IA.
Poursuites pour la fusillade de Tumbler Ridge. Trente nouvelles poursuites accusent OpenAI de complicité dans la fusillade de Tumbler Ridge, affirmant que l'entreprise a ignoré des signaux de sécurité concernant les conversations ChatGPT du suspect.
Entreprises
Palo Alto rachète Console. Palo Alto Networks a payé 500 millions de dollars pour Console, une start-up d'agents d'IA qui automatise les tâches de support informatique, afin d'ajouter des résultats de sécurité autonomes à sa plateforme Cortex.
HiddenLayer lève 100 millions de dollars. La start-up de sécurité IA HiddenLayer a levé 100 millions de dollars, alors que les entreprises dépensent davantage pour protéger modèles d'IA, agents et flux de travail contre les attaques adverses.
Wonderful atteint 5 milliards de dollars. Wonderful, la start-up qui développe un OS pour l'IA, a levé 550 millions de dollars, doublant sa valorisation à 5 milliards. Elle élargit son activité des agents de service client à la coordination de flux de travail dans 35 pays.
Passage à l'échelle des agents en entreprise. Schneider Electric, Vodafone et monday.com ont construit des couches d'infrastructure pour l'observabilité, l'évaluation et le déploiement, après avoir découvert que les agents sont faciles à prototyper mais difficiles à exploiter.
Détection d'arnaques Alexa. Alexa for Shopping d'Amazon peut désormais comparer un message à l'historique des envois d'Amazon pour confirmer s'il est authentique, ce qui aide les utilisateurs à repérer les arnaques par usurpation d'identité.
C'est tout pour aujourd'hui - environ 5 minutes de lecture.