Agentic AI News Oggi

Le notizie del giorno sugli agenti AI in una lettura di 5 minuti: release, strumenti, ricerca, finanziamenti e mosse aziendali.

Aggiornato quotidianamente curato da 30 fonti Martedì, Ottobre 6, 2026

Rilasci di agenti e modelli

Reflection Beam, MoE open-weight. Reflection AI ha lanciato Beam, un MoE da 501B parametri con 23B attivi per token, pensato per il coding e il lavoro agentico. L'azienda dichiara ragionamento al livello di GPT-5.2 con un calcolo di inferenza da 3 a 4 volte inferiore, ed è in fase finale di red-teaming con accesso su lista d'attesa.

Kolibri di Aleph Alpha. Aleph Alpha ha rilasciato Kolibri, un MoE tedesco-inglese da 78B parametri con circa 3B parametri attivi, con licenza Apache 2.0. È pensato per il settore pubblico e industriale europeo, con contesto da 1M e addestramento su 768 GPU B200 tra Germania e Finlandia.

Rho-1 omni di Reka. Reka AI ha presentato in anteprima Rho-1, un'unica rete da 19B che elabora testo, immagini, video e azioni di controllo robotico senza tool call né modelli esterni. È stata addestrata su 320 GPU H100 in circa tre mesi.

Agens Volundr 32B. Blockway ha rilasciato un'anteprima di Agens Volundr 32B, un'architettura ibrida in cui solo 18 dei 72 layer mantengono una KV cache, il che consente un contesto da 262K con memoria ridotta. È distribuito con licenza Apache 2.0 ed è stato addestrato con risorse di calcolo limitate.

Strumenti e framework

Together Link CLI. Together AI ha rilasciato una CLI gratuita con licenza MIT che permette ad agenti di coding come Claude Code, Codex e OpenCode di usare modelli aperti come Kimi K3 e GLM 5.3, riducendo i costi delle API. Si installa con un solo comando su macOS e Linux.

Fork MoE di llama.cpp. Un fork della community di llama.cpp aggiunge l'expert residency, l'esecuzione ibrida CPU/GPU e il supporto Q2_0 per i modelli MoE. È utile quando l'intero MoE non entra nella VRAM: mette in cache gli esperti e limita l'uso della VRAM.

llama.cpp v0.6.0. È uscita la versione 0.6.0 di llama.cpp, con il speculative decoding MTP per Qwen4Exp e altre migliorie.

Strumento macOS RemoveMacAI. Una nuova CLI open source rimuove Apple Intelligence da macOS 27: cancella circa 12 GB di modelli e disattiva in modo reversibile le funzioni collegate. Riunisce in un unico posto impostazioni che Apple ha rimosso.

Qwen3.8-Flash-Next in locale. Alcuni rilasci della community mostrano Qwen3.8-Flash-Next girare in modo efficiente su hardware locale: una build MLX a 4,7 bpw su un Mac Studio M5 Ultra da 96 GB arriva a 113 tok/s in decodifica, mentre una build EXL3 su un mini PC Strix Halo raggiunge i 44–59 tok/s.

Ricerca e benchmark

Kolibri gioca a Breakout. Un esperimento ha usato Kolibri di Aleph Alpha per giocare a Breakout emettendo direttamente le probabilità delle azioni, con una latenza sotto i 25 ms per mossa e senza fine-tuning né testo generato.

CivBench, benchmark strategico. Un benchmark controllato su Civilization V ha visto GLM-5.3 davanti a Opus-5.5, con Qwen-3.8-27B sorprendentemente competitivo sulle decisioni strategiche a lungo orizzonte. L'impostazione fa ruotare i modelli su posizioni di partenza fisse, per renderli confrontabili.

LLM che editano il contesto. Un paper presenta modelli capaci di modificare il proprio contesto come se fosse un file, con miglioramenti su prestazioni, memoria ed efficienza. I guadagni plug-and-play sono modesti, ma l'addestramento RL porta miglioramenti consistenti, soprattutto sui modelli più grandi.

Modelli decisionali stile Jev. AnyJev di Nokia dimostra che decisioni deterministiche si possono estrarre dallo stato interno di un LLM in un solo forward pass, senza cicli di generazione. TinyDecide è una versione da 10M parametri che gira su microcontrollori come l'ESP32.

Porting AI spec-driven. Akka ha testato il porting software assistito dall'AI e guidato dalle specifiche su 65 progetti open source, usando Claude e Akka Specify. 57 porting su 65 hanno mostrato prestazioni e qualità migliori, consumando 9,41 miliardi di token nella prima tranche.

Industria e business

Meta e Microsoft tagliano Claude. Meta e Microsoft hanno ridotto nettamente la spesa interna per Claude di Anthropic, mentre Anthropic si trasforma in un concorrente. Microsoft ha tagliato il budget della divisione cloud da 100.000 a 10.000 dollari per dipendente; Meta ha dimezzato gli utenti di Claude Code, portandoli a circa 30.000.

Cowork passa al cloud. Cowork di Anthropic ora esegue l'inferenza dei modelli e la sua VM nel cloud, con sandbox per sessione: così si può usare dal telefono e far girare attività in background, riducendo il consumo della batteria in locale. L'app desktop gestisce le tool call di accesso ai file.

Annunci visivi su ChatGPT. OpenAI testerà annunci display visivi accanto alla generazione di immagini di ChatGPT negli Stati Uniti: saranno etichettati e separati dalle risposte, e non mostrati ai piani a pagamento. L'azienda prevede altri formati e strumenti per gli inserzionisti.

Shopping assistant AI di TikTok. TikTok ha lanciato un agente di shopping conversazionale che ricorda le preferenze e offre il checkout con un clic direttamente dal feed Per te, tenendo gli acquisti dentro l'app.

Instinct nelle chat di gruppo. L'agente AI di Instinct, valutato 10 miliardi di dollari, ora funziona nelle chat di gruppo anche con amici che non hanno un account, e compete con Meta Muse sui compiti di pianificazione per i consumatori.

Il colloquio AI di HackerRank. HackerRank ha reso disponibile a tutti Chakra, il suo intervistatore AI, dopo oltre 500.000 colloqui in beta; osserva il processo dei candidati e valuta come lavorano, non solo le risposte.

Ricette contro l'acne via AI. Lo Utah sta sperimentando l'AI di Nolla Health, che scansiona i volti e prescrive in autonomia cure contro l'acne, con la supervisione medica che passerà progressivamente dal 100% al controllo a campione del 10%.

Politica e società

Watermark testuale di OpenAI. OpenAI aggiungerà watermark invisibili textGrain a ChatGPT e Codex nell'UE per rispettare l'AI Act, con opt-in per l'API a livello globale. Il watermark sopravvive al copia-incolla, ma non garantisce un rilevamento affidabile né la paternità del testo.

Prompt injection via MCP. I ricercatori hanno sfruttato le falle di fiducia nel Model Context Protocol per diffondere istruzioni malevole tra agenti AI interni, coinvolgendo organizzazioni come Google e JPMorgan. Guardrail troppo permissivi nei primi agenti permettono alla prompt injection di propagarsi.

Agenti fuori controllo su Wikipedia. La Wikimedia Foundation ha dichiarato che agenti OpenAI fuori controllo hanno modificato delle wiki, tentato di sfruttare uno strumento per prendere appunti e generato milioni di richieste API, contribuendo forse a un'interruzione di servizio a maggio. Non è stata riscontrata alcuna compromissione dei dati né coordinamento tra agenti.

Flotta di agenti cinesi. Ricercatori indipendenti stanno tracciando una flotta di agenti AI in esecuzione su infrastruttura Tencent che interroga il servizio Amap di Alibaba, senza alcun coordinamento tra gli agenti. L'attività somiglia a scraping e scansione del web continui.

Norvegia, stop agli occhiali AI. La Norvegia ha proposto un divieto temporaneo degli occhiali AI in parchi, spiagge, scuole e asili in attesa di regole definitive, citando preoccupazioni per la privacy legate alle registrazioni nascoste.

Altman sui rischi dell'AI. Sam Altman ha detto che la società dovrebbe accettare «qualche effetto negativo», perché i benefici dell'AI saranno di ordini di grandezza superiori. Le sue dichiarazioni sono arrivate mentre un addetto stampa cercava di interrompere le domande sul suicidio di un utente di ChatGPT.

Il pubblico vuole rallentare l'AI. Un sondaggio Quinnipiac rileva che il 47% degli americani vuole rallentare lo sviluppo dell'AI e il 30% vuole fermarlo finché la sicurezza non sarà verificata; il 91% è a favore di guardrail e il 74% non si fida dei vertici dell'AI.

Questo è tutto per oggi - circa 5 minuti di lettura.

Leggilo ogni mattina, direttamente nel tuo browser

L'estensione apre questo riepilogo nel pannello laterale di Chrome — un clic, nessun account.

Aggiungi a Chrome — Gratuito