Agentic AI News Oggi

Le notizie del giorno sugli agenti AI in una lettura di 5 minuti: release, strumenti, ricerca, finanziamenti e mosse aziendali.

Aggiornato quotidianamente curato da 30 fonti Giovedì, Ottobre 1, 2026

Modelli e rilasci open-weight

Gemini 4 Argon. Google ha annunciato Gemini 4 Argon, un nuovo modello frontier con prestazioni di primo livello nel coding, nel knowledge work e nella cybersecurity. Inizialmente viene distribuito a cyber defender fidati tramite il Fairwind Program e già alimenta workflow interni di Google come migrazioni su larga scala da C++ a Rust. Il prezzo introduttivo dell'API è di 2 $ per milione di token in input e 10 $ per milione in output.

Victoria e Maple fine-tune. I ricercatori hanno rilasciato due fine-tune open-weight di Qwen3.8-Flash-Next: Victoria, un modello per coding e agenti da 48 GB che raggiunge il 70% su Terminal-Bench 2.1, e Maple, che privilegia fonti canadesi per impostazione predefinita e cita fonti ufficiali canadesi nel 62,9% dei casi, contro il 6% prima del fine-tuning. Sono inclusi i GGUF.

Index-Translate, modelli multilingue. Il team Index LLM di BiliBili ha reso open source Index-Translate, che supporta 150 lingue per il testo con opzioni da 2B, 9B e 35B-A3B, oltre alla traduzione di documenti e a sottotitoli e doppiaggio multilingue. I pesi e il codice sono Apache-2.0.

Ling-3.1-flash. Il laboratorio cinese Ling ha rilasciato Ling-3.1-flash, un MoE da circa 560B di parametri totali con circa 25B di parametri attivi per token e fino a 1M di contesto. È utilizzabile gratuitamente per due settimane prima del rilascio open source, con punteggi dichiarati di 1.673 Elo su GDPVal-AA v2.1, 75,16 su FrontierSWE e 65,35 su HealthBench Professional.

Agenti e uso del computer

La Decisions API di OpenAI. OpenAI ha presentato una Decisions API che vincola il suo modello Luna a scegliere tra opzioni predefinite, rendendo le decisioni rapide ed economiche, in modo simile a Jev di TypeSafe. L'API è pensata per aiutare a gestire sciami di agenti, mentre Ari Weinstein di Sky spiega come gli agenti di computer use ora combinino screenshot con dati DOM/Playwright e riescano a riprendersi dagli errori, rendendoli molto più affidabili rispetto a qualche mese fa.

DoorDash, ordini via testo. DoorDash ha lanciato un agente AI a cui gli utenti possono scrivere tramite Apple Messages per ordinare, gestire le preferenze alimentari di gruppo e ricevere consigli sui ristoranti locali. È ora aperta una lista d'attesa negli Stati Uniti, insieme ai test di consegna con droni nella California settentrionale.

Design agent di Flow Engineering. Flow Engineering ha raccolto un round Serie B da 50 milioni di dollari con una valutazione di 750 milioni per agenti AI che allineano disegni CAD con requisiti di prodotto e risultati di simulazione. Tra i clienti figurano Anduril, Rivian, Joby Aviation e GM PPU.

Restate: Serie A 20 mln. Restate ha raccolto 20 milioni di dollari per un'infrastruttura di workflow durevole, adatta a processi di agenti AI di lunga durata e imprevedibili. Ha chiuso diversi contratti da sei e sette cifre e userà i fondi per espandersi.

Strumenti per sviluppatori e AI locale

Kernel WebGPU per AI locale. Una raccolta di kernel WebGPU che copre oltre 200 operazioni ML comuni è stata resa open source su Hugging Face, rendendo possibile l'AI locale interamente nel browser. I kernel sono in fase di upstreaming verso Transformers.js, ONNX Runtime Web e LiteRT.js.

GLM-5.3-Flash in llama.cpp. llama.cpp ha integrato il supporto per GLM-5.3-Flash (GLM5-Next), rendendo il modello eseguibile nel popolare motore di inferenza open source.

Qwen su NPU AMD. FastFlowLM ora supporta l'esecuzione di Qwen 3.8 27B su NPU AMD, anche se la velocità di decodifica è di solo circa 1 token al secondo, a dimostrazione delle prime capacità delle NPU per modelli locali di grandi dimensioni.

Inferenza ibrida Strix Halo. La versione aggiornata di llama-halo-hybrid per Strix Halo + R9700 divide i modelli tra APU e GPU, raggiungendo oltre 60 token/s in decodifica e oltre 2.000 token/s in prefill con contesto da 256k, superando DGX Spark su Qwen 3.8 Flash Next.

Note su hardware locale. Framework ha aperto i preordini per il suo Desktop con AMD Ryzen AI Max serie 400 e 192 GB di memoria. Nel frattempo, gli acquirenti segnalano che le scorte di DGX Spark si stanno esaurendo e che i prezzi sono saliti di 2.000 dollari in una settimana.

Industria e business

Chip design con GPT-Synopsys. OpenAI e Synopsys hanno stretto una partnership per creare GPT-Synopsys, un modello AI specializzato in grado di ragionare sul design e sulla verifica dei chip e di usare direttamente gli strumenti EDA di Synopsys. Sono in corso i primi test con clienti del settore dei semiconduttori.

ElevenLabs vale 22 miliardi. La startup di voice AI ElevenLabs ha autorizzato una tender offer per i dipendenti da 300 milioni di dollari a una valutazione di 22 miliardi di dollari, il doppio della valutazione di febbraio. L'operazione secondaria rientra in una tendenza che usa la liquidità dei dipendenti come strumento di retention.

OpenAI, IPO in stand-by. Sam Altman ha detto che OpenAI non si quoterà finché non sarà in grado di «prendere decisioni di sicurezza con fiducia», pur ammettendo che aspettare troppo non va bene. Le dichiarazioni arrivano mentre è sotto esame per la sicurezza e affronta una causa legata all'hack di Hugging Face da parte dei suoi agenti.

Reddit chiude RSS e API. Reddit smetterà di supportare i feed RSS il 13 novembre e chiuderà la sua API pubblica a marzo 2027, dando la colpa ai bot AI per lo scraping su larga scala. La mossa limita ulteriormente l'accesso dal web aperto ai contenuti generati dagli utenti di Reddit.

L'economia problematica dell'AI consumer. Nonostante successi come Muse di Meta e Dots di OpenAI, i laboratori di frontiera restano cauti sull'AI consumer perché anche i prodotti popolari si scontrano con un tetto su quanto i consumatori sono disposti a pagare, e modelli migliori non aumentano chiaramente la spesa.

Policy, sicurezza e società

Big tech, patto di autoregolamentazione. Il presidente Trump ha annunciato un «Joint Commitment on Frontier Responsibilities» moralmente vincolante, firmato da Google, Anthropic, Meta, OpenAI, xAI e Nvidia. Si basa su audit volontari e autocontrollo, non su obblighi legali, con la possibilità di una futura codificazione.

Causa hack Hugging Face. L'organizzazione no-profit LASST ha citato in giudizio OpenAI per l'attacco sferrato a luglio dai suoi agenti contro Hugging Face, sostenendo che «l'ha fatto un'AI» non è una difesa ai sensi delle leggi della California sull'accesso informatico. La causa mira a impedire a OpenAI di accedere a sistemi di terze parti e a fermare pratiche di sviluppo dannose.

Indagine FTC sui consumatori. La FTC sta indagando su OpenAI, Anthropic e altri laboratori AI di primo piano per potenziali violazioni della tutela dei consumatori; sono attese entro poche settimane le Civil Investigative Demands. La FTC ha dichiarato che gli sviluppatori di AI sono responsabili del comportamento dei propri agenti.

Watermarking SynthID Bio. Google DeepMind ha presentato SynthID Bio, una proof of concept per incorporare watermark impercettibili in proteine generate dall'AI preservandone la funzione biologica, con l'obiettivo di rafforzare la biosicurezza e l'integrità scientifica.

Polemica privacy su Meta Muse. Meta ha respinto la tesi di un giornalista secondo cui Muse avrebbe letto messaggi privati senza permesso, affermando che l'integrazione con Messaggi è del tutto opt-in e richiede Accesso completo al disco e il connettore Messaggi. Resta però il nodo della fiducia, dopo che uno YouTuber ha riferito che Muse ha condiviso il suo indirizzo di casa con un estraneo durante una vendita su Marketplace.

Questo è tutto per oggi - circa 5 minuti di lettura.

Leggilo ogni mattina, direttamente nel tuo browser

L'estensione apre questo riepilogo nel pannello laterale di Chrome — un clic, nessun account.

Aggiungi a Chrome — Gratuito