Agentic AI News Oggi

Le notizie del giorno sugli agenti AI in una lettura di 5 minuti: release, strumenti, ricerca, finanziamenti e mosse aziendali.

Aggiornato quotidianamente curato da 30 fonti Giovedì, Ottobre 8, 2026

Modelli e interfacce

Claude Haiku 5.5. Il nuovo modello veloce ed economico di Anthropic offre un contesto da 1 milione di token e porta il prezzo dei prompt a 0,10 $/M fino a 100K token, allineandosi a GPT-6 Luna; il suo tokenizer però conta circa il 25-30% di token in più e oltre i 100K il prezzo quintuplica. I benchmark mostrano un balzo netto rispetto a Haiku 4.5 e prestazioni competitive nel coding agentico.

Mistral Large 4 "Le Chonk". Mistral ha rilasciato in anteprima un modello open-weight da mille miliardi di parametri, ottimizzato per il coding, la cyberdifesa e settori specifici, sostenendo di avere capacità vicine ai modelli di frontiera statunitensi e cinesi.

Modelli decisionali Liquid AI. Liquid AI ha reso open source d1-3B e d1-omni-600M, modelli decisionali multimodali che restituiscono risposte calibrate sì/no, a scelta o a punteggio senza produrre token in output. d1-3B dichiara le migliori prestazioni sotto i 10B sul Decision Index e gira in appena 16 ms su hardware NVIDIA Jetson; è comparso anche un port WebGPU per il browser.

L'API Decisions di OpenAI. OpenAI ha lanciato in beta l'API Decisions per valutazioni sì/no, categoriche e su scala a partire da testo o immagini, circa 10 volte più veloce di Responses. Supporta GPT-6 Luna a 0,10 $/M in input, con i token di output gratuiti.

Interfaccia intelligente di ChatGPT. Con GPT-6, ChatGPT può restituire grafici interattivi, pulsanti, moduli e mini-app invece di semplice testo. OpenAI spiega che il ragionamento parte già durante la fase di thinking per ridurre i tempi di attesa; gli utenti paganti ricevono GPT-6 Sol, quelli gratuiti Luna.

Generazione video Kandinsky 6.0. Kandinsky Lab ha rilasciato Kandinsky 6.0 Pro (29B) e Lite (3B), con supporto a ComfyUI e Diffusers e un nuovo upscaler per i video.

Nemotron alle olimpiadi. Modelli Nemotron fine-tunati hanno raggiunto un risultato non ufficiale di livello oro all'IOI 2026 (535,4/600) e un oro ufficiale all'IMO 2026 con 30/42 punti, usando SFT, RL e il ciclo generate-verify-refine.

Agenti e framework

Gli agenti di Nous Research. Nous Research ha raccolto 90 milioni di dollari su una valutazione da 1,5 miliardi e ha lanciato Hermes for Businesses, pensato per gli agenti AI in azienda. Il suo Hermes Agent open source è stato clonato 24 milioni di volte e genera circa il 2,5% dell'uso globale di token AI.

Deep Agents di LangChain. LangChain ha introdotto aggiornamenti a Skills che legano gli strumenti alle skill per contenere il contesto, oltre a Managed Deep Agents v0.9, con pianificazioni create dall'agente, configurazione per singola esecuzione e reazioni su Slack.

Le azioni di Copilot. Hybrid Intelligence di Microsoft permetterà a Copilot di accedere ai file locali e di compiere azioni su Windows, come trovare, rinominare, comprimere in zip e inviare via email documenti per l'utente.

Muse di Meta su iPad. Muse, l'assistente agentico di Meta, ora supporta nativamente l'iPad dopo aver raggiunto 6,6 milioni di installazioni, e aggiunge connettori per strumenti come Canva, GitHub e QuickBooks.

Agent Lightning RL. Microsoft Research ha reso open source Agent Lightning v1.0, un framework di RL agentico da 3.500 righe che usa harness di deployment reali e Kubernetes nativo. In un esempio ha portato il Pass@1 di Qwen3.5-9B su SWE-bench Verified dal 41,8% al 56,4% con circa 6.000 campioni di training.

IA locale e strumenti per sviluppatori

ROCm 10.1. ROCm 10.1 di AMD punta sul collo di bottiglia del movimento dati nell'inferenza locale; il rilascio è stato discusso dagli utenti di IA locale su Reddit.

Speedup MoE in llama.cpp. llama.cpp ha introdotto una cache GPU per gli esperti MoE tenuti in memoria host, promettendo forti speedup sui modelli che non entrano interamente nella VRAM, e ha aggiunto il supporto a GLM5Next MTP.

Controlli sui repository in Unsloth Studio. Unsloth Studio ora ricontrolla i repository di modelli attendibili prima di eseguirli, dopo che versioni compromesse di LiteLLM su PyPI hanno mostrato come gli attacchi alla supply chain possano arrivare fino agli strumenti di IA.

GLM-5.3-Flash su doppia GPU. Una configurazione con due CMP 170HX da 64 GB fa girare GLM-5.3-Flash con contesto a 384K e circa 90 token/s tramite EXL3: il MoE da 320B tiene i pesi attivi in HBM ed è messo a confronto con Qwen3.8-Flash-Next.

Benchmark Qwen in locale. Recenti valutazioni della community confrontano i fine-tune di Qwen3.8-27B e Qwen3.8-Flash-Next con i modelli di frontiera su task di dominio e di coding. Una valutazione da 469 domande ha rilevato che i modelli locali possono avvicinarsi ai risultati dei modelli di frontiera con privacy e costi inferiori, anche se resta il problema dell'uso eccessivo dei token di thinking.

Hardware e Windows

Hardware Surface con IA. Microsoft ha annunciato il Surface Laptop Ultra e il Surface RTX Spark Dev Box, entrambi basati sul chip RTX Spark di Nvidia per architettura Arm. Il laptop parte da 2.599 dollari con fino a 128 GB di memoria unificata e arriva sul mercato il 16 ottobre; il Dev Box parte da 5.999 dollari ed è pensato per far girare modelli locali da oltre 120B.

Industria e business

Capire il codice è il nuovo collo di bottiglia. Un sondaggio su 300 manager senior dell'ingegneria ha rilevato che gli agenti di coding AI hanno spostato il collo di bottiglia su debug e comprensione: i team passano ora 9,8 ore a settimana a scrivere codice ma 16,9 ore a settimana a fare debug. Il rapporto segnala un rischio crescente nei codebase mission-critical.

Il progetto della cellula virtuale. Biohub coordina un'iniziativa da 1,8 miliardi di dollari per costruire modelli AI in grado di prevedere il comportamento delle cellule. Google DeepMind, Meta e Isomorphic Labs investono 300 milioni, mentre il Dipartimento dell'Energia statunitense mette più di 500 milioni per misurazioni di laboratorio e potenza di calcolo.

Clone Adobe open source. Lo sviluppatore Brandon Thomas ha usato Claude Opus 5.5 per costruire Artcraft, una suite di sette app open source in Rust/WebAssembly che clonano Photoshop, Illustrator, Premiere e altri programmi Adobe. Le app sono agli inizi e hanno ancora molte lacune, ma il progetto mostra come l'IA possa sostenere una reimplementazione clean-room.

SynthID aperto al pubblico. Google ha aperto al pubblico il suo detector SynthID, che permette a chiunque di verificare se immagini, video e audio contengono watermark di Google o dei suoi partner. Il sistema ha già marcato più di 180 miliardi di contenuti ed è integrato anche in Chrome e Gemini.

Playground di Google. Google Labs ha lanciato Playground, una piattaforma browser in cui gli adulti statunitensi possono creare giochi da prompt testuali, con il supporto di Gemini, Nano Banana e Lyria. Unity ha annunciato a sua volta Unity Spark per lo sviluppo professionale di videogiochi assistito dall'IA.

Questo è tutto per oggi - circa 5 minuti di lettura.

Leggilo ogni mattina, direttamente nel tuo browser

L'estensione apre questo riepilogo nel pannello laterale di Chrome — un clic, nessun account.

Aggiungi a Chrome — Gratuito