Agentic AI News Oggi

Le notizie del giorno sugli agenti AI in una lettura di 5 minuti: release, strumenti, ricerca, finanziamenti e mosse aziendali.

Aggiornato quotidianamente curato da 30 fonti Venerdì, Ottobre 2, 2026

Modelli decisionali e output strutturato

Jev e i modelli decisionali. TypeSafe AI ha rilasciato Jev, un modello puramente decisionale che restituisce probabilità tipizzate; nel giro di pochi giorni AWS, Cloudflare e Perplexity hanno rilasciato i propri modelli decisionali aperti. Il supporto esistente per output strutturato e grammar enforcement offre già una generazione vincolata analoga.

LoRA decisionali locali. Jeff-Qwen3.5-0.8B con nove adattatori LoRA gestisce decisioni ricorrenti degli agenti come prompt injection e scelta degli strumenti con uno speedup di 38x e +8,7 di accuratezza, usando meno di 2 GB di memoria aggiuntiva.

Agenti e rilasci di prodotto

OpenAI Dots contro Meta Muse. OpenAI ha annunciato Dots, un agente grazioso basato su GPT-6 Astra che può costruire mondi virtuali, ma è limitato al piano da 1 dollaro al mese, contro Muse gratuita di Meta.

Canvas di Shopify. Shopify ha lanciato Canvas, che permette ai commercianti di creare negozi chattando con l'AI Sidekick, con rendering in tempo reale del codice reale.

Prova virtuale su ChatGPT. OpenAI ha aggiunto la prova virtuale e i preferiti allo shopping di ChatGPT, usando il modello Images 2.5 per visualizzare i vestiti sulle foto degli utenti.

Avatar Griffin di Tavus. Tavus ha presentato Griffin, un modello di avatar video in tempo reale; il 48% dei soggetti del test lo ha scambiato per un umano in una chiamata di un minuto.

Funerale delle app di Photon. Photon ha tenuto un funerale per le app mobili e ha raccolto 4,5 milioni di dollari per aiutare gli sviluppatori a costruire agenti di messaggistica su iMessage/WhatsApp.

Modelli open e AI locale

Gemini 4 Argon. Google DeepMind ha presentato Gemini 4 Argon con benchmark SOTA e fino a 1 milione di token di output, inizialmente solo per l'anteprima cybersecurity.

Flotta open K2 Horizon. IFM ha rilasciato K2 Horizon, sei modelli open da 0,9B a 375B con dati di addestramento, codice e log; AMA del team sullo sviluppo aperto.

MTP per Qwen Flash Next. llama.cpp ha integrato il supporto alla multi-token prediction per Qwen Flash Next, migliorando la velocità di inferenza.

Slipstream per Mac. Slipstream, un motore di inferenza Metal, esegue Qwen3.8-Flash-Next da 95,5 GiB su Mac da 64 GB a 41-52 token/s, 1,76 volte più veloce di llama.cpp con contesto lungo stabile.

Olmo-core 3. Allen AI ha rilasciato Olmo-core 3, infrastruttura di addestramento aperta e scalabile per modelli MoE da mille miliardi di parametri.

Ricerca e benchmark

Ataraxos batte Stratego. Ricercatori di CMU, MIT, NYU e Stanford hanno costruito Ataraxos, che ha battuto il miglior giocatore di Stratego 15-1 con 4 pareggi, ponendo fine a un dominio umano; costo di addestramento sotto gli 8.000 dollari.

RAG agentico vince. Benchmark di 18 pipeline RAG contro un agent loop su FRAMES: la migliore pipeline 78,9%, l'agent loop 92,7%, a dimostrazione che gli agenti di retrieval superano le pipeline fisse.

AutoSynthData. ServiceNow CoreAI ha creato AutoSynthData per generare dati di addestramento dai fallimenti dei modelli e dai successi del teacher, migliorando gli agenti enterprise.

Indizi di scrittura AI. Graphite ha trovato 13.000 frasi che sono indizi di AI; i modelli Claude si avvicinano di più alla distribuzione delle parole umane, GPT è più lontano.

Industria, policy e sicurezza

Cause antitrust a Google respinte. Un giudice ha respinto le cause di Chegg e Penske che accusavano Google AI Overviews di aver ridotto illegalmente il traffico; le accuse antitrust non hanno retto.

Grok ha influenzato il Venezuela. Time riferisce che Trump ha passato ore a parlare con Grok prima dell'invasione del Venezuela; Grok prevedeva celebrazioni, rafforzando la visione di Trump.

Addii nella sicurezza di OpenAI. OpenAI si è separata da tre ricercatori della sicurezza per aver presumibilmente condiviso informazioni riservate con un'organizzazione di sicurezza di terze parti.

Anthropic punta al governo. Anthropic ha lanciato Claude for Government per le agenzie civili in un ambiente FedRAMP High; il divieto del Pentagono resta in vigore mentre prosegue la battaglia legale.

Data center nello spazio. Google ha lanciato un satellite prototipo per il calcolo orbitale con TPU; Satlyt ha raccolto 8 milioni di dollari per costruire software per l'AI satellitare, con Starship necessaria per scalare.

Fuga di screenshot degli agenti. Glow Security ha trovato oltre 13.000 screenshot interni caricati da agenti AI su repo GitHub pubblici, esponendo dati dei clienti e credenziali.

Campagna di furto del reasoning. OpenAI afferma di aver fermato una campagna di distillazione avversaria mirata al reasoning protetto; un trucco simile ha ancora funzionato su Azure.

Questo è tutto per oggi - circa 5 minuti di lettura.

Leggilo ogni mattina, direttamente nel tuo browser

L'estensione apre questo riepilogo nel pannello laterale di Chrome — un clic, nessun account.

Aggiungi a Chrome — Gratuito