Agentic AI News Oggi

Le notizie del giorno sugli agenti AI in una lettura di 5 minuti: release, strumenti, ricerca, finanziamenti e mosse aziendali.

Aggiornato quotidianamente curato da 30 fonti Sabato, Agosto 22, 2026

Modelli locali e workflow per agenti

Qwen3.8-27B low quant vince. Gli utenti trovano che Qwen3.8-27B rimane solido per l'agentic coding anche a Q3_xxs e Q6; i preset di reasoning basso/medio ottengono punteggi alti e riducono i loop, con preserve_thinking che evita ragionamenti ripetuti.

Purgatorio da 16GB di VRAM. Una configurazione Windows con 16GB di VRAM esegue Qwen3.8-27B con MTP disabilitato, cache quantizzata e contesto di circa 100k, spostando il modulo di visione nella RAM.

Inferenza locale più veloce. vLLM su due RTX 3090 raggiunge 143 tok/s per Qwen3.8-27B; le ricette dedicate a Strix Halo offrono opzioni Q8/Q6/Q5 con Unsloth Dynamic Quants.

Flight sim MacBook 63 ore. Un Qwen3.8-27B a 3 bit su MacBook Air M2 ha impiegato 63 ore ma alla fine ha prodotto un simulatore di volo HTML funzionante, dimostrando che l'agentic coding locale è possibile ma lento.

Harness e infrastruttura per agenti

Harness batte il modello. L'harness personalizzato di Nvidia, con gestione della memoria e un componente supervisore, ha portato Claude Opus 5 dal 30% al 100% su ARC-AGI-3, dimostrando che il wrapper dell'agente può contare più della semplice scelta del modello.

DeepSeek Flash Vision. DeepSeek-V4-Flash-Vision-Exp aggiunge la comprensione delle immagini per i workflow degli agenti e quasi eguaglia Opus 4.8 nei benchmark interni per agenti; l'harness aggiornato supporta input di immagini nei comandi e in MCP/ACP.

Agenti AI Cloudflare. Cloudflare ha ridotto le issue aperte di Astro di circa l'85% usando agenti isolati di GitHub Actions che riproducono, diagnosticano, verificano e correggono; inoltre converte gli standard di ingegneria in controlli imposti dall'AI.

Azure DevOps MCP. Il server MCP ospitato da Microsoft per Azure DevOps è generalmente disponibile, ma Claude Desktop, ChatGPT e Cursor non possono ancora connettersi perché la registrazione del client di autenticazione Entra non è supportata.

Aggiornamenti CLI LLM. llm 0.32.1 corregge un pin di dipendenza OpenAI rotto, e llm-openrouter 0.7 aggiunge tracce di reasoning e strumenti server-side Shell, WebFetch e WebSearch.

Rilasci di modelli e sicurezza

Jailbreak su Opus 4.6. TechCrunch ha scoperto che Claude Opus 4.6 produce contenuti sessuali espliciti in 10/10 richieste dirette; i modelli più vecchi condividono un jailbreak multi-turno mentre le versioni recenti di Opus resistono.

Sicurezza con Claude Mythos 5. Anthropic sta usando Claude Mythos 5 in uno scanner di sicurezza del codice per clienti enterprise, suggerendo patch con approvazione umana e dando ai partner accesso senza interazione diretta con il modello.

Generazione immagini trasparenti. Il GPT-Image-2 di OpenAI ora può generare PNG senza sfondo via API, utile per foto di prodotto e icone; il canale alpha è incorporato durante la generazione.

Anteprima di dots3-note. llama.cpp aggiunge il supporto per dots3-note, un modello MoE da 280B con 16B di parametri attivi, contesto di 512K e comprensione multimodale di testo, immagini, video e audio.

Ricerca e benchmark

SWE-bench Science. Un nuovo benchmark di 119 task di software scientifico mostra che il miglior agente, Claude Code con Opus-5 max, ottiene un punteggio inferiore al 50%, con modalità di errore comuni nella conoscenza scientifica, nell'esplorazione, nella generalizzazione e nell'integrazione.

Trace judge più economico. LangSmith ha messo a punto un modello Qwen con Fireworks per rilevare errori percepiti nelle tracce di produzione, eguagliando le prestazioni di frontiera a un costo fino a 100 volte inferiore.

Scaling law delle simulazioni. Simile AI, con un round di Serie B da 2 miliardi di dollari, esegue simulazioni del comportamento umano per aziende Fortune 100 e dichiara un'accuratezza dell'85-99% rispetto ai focus group; il CEO Joon Sung Park discute il passaggio dagli agenti generativi ai gemelli digitali.

Industria e business

Accordo Nvidia-Poolside. Nvidia ottiene in licenza la Model Factory di Poolside e assume 109 dipendenti nell'ambito di un accordo da 6 miliardi di dollari, oltre a investire 1 miliardo di dollari; l'accordo non è né un'acquisizione né un acquihire.

Investimenti nei data center. Nvidia acquisisce una partecipazione di minoranza in Cloverleaf Infrastructure per accelerare lo sviluppo dei data center, dopo aver investito 1,5 miliardi di dollari in SB Energy.

Opposizione ai data center. Il 75% degli americani ora si oppone ai data center vicini, in aumento dal 42% di un anno fa, con preoccupazioni per energia, acqua e uso del suolo.

Corsa USA-Cina sull'AI. Gli Stati Uniti stanno redigendo una lettera che chiede ai paesi partner di scegliere da che parte stare nell'AI, avvertendo che aderire all'iniziativa della Cina li escluderebbe da Pax Silica.

Impennata dei ricavi OpenAI. GPT-5.6 Sol ha fatto salire i ricavi trimestrali di OpenAI del 35% e i ricavi enterprise di oltre il 50%, superando la crescita dell'API business di Anthropic nel Q3.

Questo è tutto per oggi - circa 5 minuti di lettura.

Leggilo ogni mattina, direttamente nel tuo browser

L'estensione apre questo riepilogo nel pannello laterale di Chrome — un clic, nessun account.

Aggiungi a Chrome — Gratuito