Agentic AI News Oggi

Le notizie del giorno sugli agenti AI in una lettura di 5 minuti: release, strumenti, ricerca, finanziamenti e mosse aziendali.

Aggiornato quotidianamente curato da 30 fonti Mercoledì, Agosto 12, 2026

Rilasci di modelli e infrastruttura

Il modello di Nvidia che privilegia la velocità. Nvidia ha rilasciato Nemotron 3.5 Lightning, un modello Mamba-Transformer open-weight da 30B che eguaglia GPT-OSS-120B nei benchmark pur essendo ottimizzato per un'inferenza veloce con solo 3,6B di parametri attivi.

DeepSeek V4 gira in locale. I quant della community di DeepSeek V4 risolvono i problemi di conversione per basi bit-exact, e DeepSeek V4 Flash raggiunge 27+ t/s su APU Strix Halo con decodifica speculativa, dimostrando un'implementazione locale praticabile.

App desktop Unsloth. Unsloth ha rilasciato un'app desktop open-source per eseguire e addestrare modelli locali su GPU, con esecuzione di codice in sandbox, RAG, esportazione di modelli e nessuna telemetria.

Seed da 1,1 miliardi di dollari per River AI. Fondata da Igor Babuschkin, ex co-fondatore di xAI, River AI ha raccolto 1,1 miliardi di dollari per costruire assistenti AI personalmente addestrabili ripensando l'intero stack, dall'addestramento all'hardware.

Daybreak Cyber su AWS. I modelli di cybersecurity Daybreak di OpenAI sono ora disponibili tramite Amazon Bedrock, offrendo ai difensori l'accesso a capacità cyber all'avanguardia nei loro ambienti AWS esistenti.

Il manifesto open-source di Zuck. Il CEO di Meta sostiene l'importanza di rilasci open-weight più numerosi e invita i governi a collaborare sui test di sicurezza, mentre l'azienda continua a pubblicare modelli come Muse Glimmer.

Supporto per Ling-3.0. Una pull request aggiunge Ling-3.0 a llama.cpp, con una variante minuscola che funziona già bene per i compiti vocali degli assistenti domestici grazie al suo rifiuto onesto in caso di incertezza.

Strumenti e IA locale

Il broker MCP riduce il contesto. Un harness agente fai-da-te usa un broker MCP per nascondere gli strumenti dietro un proxy, riducendo il contesto iniziale da 20K token a quasi zero, e aggiunge consapevolezza temporale per una migliore esecuzione locale.

GPU da mining per LLM. Le schede da mining CMP170HX da 8GB possono essere espanse fino a 64GB ciascuna, eseguendo modelli grandi o più modelli piccoli contemporaneamente, offrendo prestazioni Ampere-class economiche ma datate.

366 t/s su V100. Kernel CUDA personalizzati (v100-skinny) consentono fino a 366 t/s su Qwen3.6 27B in NVFP4 su GPU Volta, dando nuova vita a hardware vecchio per l'inferenza locale.

Modello TinyTitle. Un modello GRU da 1,8M di parametri genera titoli di chat in meno di 5 MiB di RAM, dimostrando una riassunzione on-device ultraleggera che gira in pochi millisecondi.

IA privata per e-reader. Un'app e-reader integra i modelli Gemma 4B localmente per domande e risposte private sui libri, con interruttori anti-spoiler e corrispondenza automatica della lingua.

Server IA a basso consumo. Una configurazione che combina un Intel N100 con una RTX 5060Ti produce un server llama.cpp silenzioso ed efficiente, in grado di eseguire modelli recenti come Qwen 3.5 per l'uso quotidiano.

Costi di inferenza ridotti drasticamente. Il CEO di Doubleword spiega come progettare stack di inferenza per un uso non in tempo reale possa ridurre i costi dei token di oltre un ordine di grandezza rispetto alle configurazioni generiche.

Instradamento intelligente dei modelli. La libreria Switchyard di NVIDIA instrada solo il 7% delle chiamate degli agenti verso un modello all'avanguardia, riducendo i costi del 74% con una perdita minima di accuratezza, e offre una formula per valutare il rapporto costi-benefici.

Occhiali AR privati. Un utente cieco chiede occhiali AR in stile Meta che eseguano modelli locali per evitare di inviare dati visivi a Meta, evidenziando la domanda di privacy nella tecnologia assistiva.

Ricerca all'avanguardia

L'IA affronta Riemann. Un modello Anthropic non rilasciato ha fatto progressi sull'ipotesi di Riemann testando 650 idee con 60 sub-agent in 36 ore, riaccendendo il dibattito sul ruolo dell'IA nella scoperta matematica.

Diagnosi video di AMIE. Il sistema di ricerca AMIE di Google ha dimostrato consultazioni cliniche video a livello esperto, usando Gemini e un setup multi-agente per interpretare segnali visivi, uditivi e contestuali.

CARE-X: IA per radiografie del torace. CARE-X di Microsoft è un VLM unificato per radiografie del torace che combina generazione e previsione strutturata, usando l'apprendimento per rinforzo per premiare la correttezza clinica.

Sfida sulla memoria agentica. ACE e ALTK-Evolve trasformano entrambi le traiettorie degli agenti in lezioni riutilizzabili; ACE costruisce un playbook completo, mentre ALTK-Evolve recupera linee guida individuali.

I logprob rilevano le allucinazioni. Analizzare le distribuzioni di probabilità dei token al primo richiamo fattuale nella catena di pensiero può rivelare conoscenze inaffidabili, offrendo un potenziale segnale precoce di allucinazione.

Avvertimento sulla scrittura con IA. S. Alpert sostiene che nessuna riscrittura è senza perdite, quindi il testo assistito dall'IA deve essere verificato personalmente per evitare di distorcere il significato voluto dall'autore.

Affari e finanza

Traguardo di 1 miliardo di utenti. ChatGPT e Gemini hanno entrambi raggiunto 1 miliardo di utenti attivi mensili, con Gemini che è il prodotto di Google più veloce a raggiungere questa scala; ChatGPT aveva raggiunto 900 milioni di utenti settimanali all'inizio dell'anno.

Le pubblicità di ChatGPT diventano globali. OpenAI ha esteso le pubblicità di ChatGPT ad altri cinque paesi, segnalando nessun impatto sulla fiducia degli utenti e bassi tassi di chiusura, mentre cerca una monetizzazione sostenibile.

Aumento dei prezzi di OpenAI. I nuovi posti Business Premium di ChatGPT costano 125 dollari per utente al mese, con una capacità cinque volte superiore e senza limiti orari, riflettendo l'elevato utilizzo di token dei carichi di lavoro agentici.

Lightcap lascia. Brad Lightcap, ex COO e responsabile dei progetti speciali di OpenAI, lascia dopo otto anni per iniziare qualcosa di nuovo, continuando una serie di uscite di dirigenti.

Locazione da 9,1 miliardi di dollari per Anthropic. Anthropic ha firmato un accordo ventennale da 9,1 miliardi di dollari per data center con il miner di Bitcoin Riot Platforms per 191 MW in Texas, destinato ad alimentare la sua prossima generazione di modelli a partire dal 2027.

Ostacoli per l'IPO di Anthropic. In vista di una potenziale IPO da 965 miliardi di dollari, gli investitori mettono in dubbio la crescita di Anthropic in mezzo a modelli cinesi economici e venti politici contrari, anche se l'azienda promuove future app per salute e biologia.

La spinta da 500 miliardi di dollari di Nvidia. Nvidia collabora con sei società finanziarie per mobilitare 500 miliardi di dollari per l'infrastruttura IA, garantendo fino al 25% del valore residuo dei suoi chip, contrastando i timori di svalutazione.

La scommessa di Accel sull'IA in India. Accel ha chiuso un fondo per l'India da 550 milioni di dollari con sovrascrizione, scommettendo che l'IA sosterrà le startup consumer, fintech e manifatturiere piuttosto che essere una categoria a sé stante.

Incasso per i dipendenti OpenAI. Un riacquisto di azioni da 7 miliardi di dollari a una valutazione di 852 miliardi di dollari consente agli attuali ed ex dipendenti OpenAI di liquidare le azioni, alleviando la pressione prima di una potenziale IPO.

Sicurezza e trasparenza

L'UE impone filigrane per l'IA. Ai sensi dell'EU AI Act, Anthropic e OpenAI si impegnano a marcare i contenuti generati; Claude incorporerà filigrane invisibili in testi e immagini, con supporto per i modelli più vecchi in lavorazione.

Provenienza delle foto Apple. iOS 27 potrebbe introdurre 'Apple Reference Image' per incorporare metadati di provenienza al momento dello scatto, consentendo agli utenti di dimostrare che le foto iPhone non sono deepfake.

Spotify segnala gli artisti IA. Spotify etichetterà i profili degli artisti generati dall'IA e li escluderà dai consigli, utilizzando sia l'autodichiarazione che il rilevamento prima di implementare il cambiamento a metà settembre.

Controversia sulla scrittura con IA. Lo studio di giochi Saber nega di aver sostituito gli scrittori con ChatGPT per Rideshare Stimulator, ma l'ex capo scrittore sostiene che l'IA sia stata usata per la scrittura e le voci, senza alcuna segnalazione su Steam.

Exploit di Zoom potenziato dall'IA. Una vulnerabilità critica di Zoom che consente il controllo del dispositivo tramite la sua funzione di annotazione è stata trovata usando meno di 20 prompt a modelli IA pubblici, mostrando una ricerca sulla sicurezza accelerata dall'IA.

Furto di tracce di ragionamento. I ricercatori hanno riprodotto token di catena di pensiero crittografati da modelli all'avanguardia in modelli fratelli più deboli, li hanno jailbreakati e hanno recuperato il ragionamento nascosto, esponendo password e chiavi API in sessioni pubbliche.

Fiducia nel codice generato dall'IA. IBM e Red Hat espandono Lightwell per creare catene di fornitura software verificabili per l'era dell'IA, garantendo provenienza e conformità alle policy sia per il codice generato da umani che da IA.

Questo è tutto per oggi - circa 5 minuti di lettura.

Leggilo ogni mattina, direttamente nel tuo browser

L'estensione apre questo riepilogo nel pannello laterale di Chrome — un clic, nessun account.

Aggiungi a Chrome — Gratuito