Agenti e lanci di prodotto
L'agente Muse di Meta. Meta ha lanciato Muse, un agente AI personale per iOS, Android e web. Può inviare email, prenotare viaggi, compilare moduli e continuare a lavorare in background su attività lunghe. Si collega alle app e ai servizi degli utenti, puntando su un'AI che agisce, non sui chatbot.
ChatGPT Images 2.5. OpenAI ha rilasciato ChatGPT Images 2.5 con generazione più rapida, modifica multi-turno migliorata e due modelli API: gpt-image-2.5-sunburst e gpt-image-2.5-flare. La nuova funzione Sketch consente di disegnare uno schizzo all'interno di ChatGPT per guidare la creazione di immagini; i commenti possono essere posizionati direttamente sulle aree dell'immagine.
Premiere con AI generativa. Adobe ha aggiornato Premiere con un pannello Generative Media che genera video, audio, musica ed effetti sonori in contesto senza uscire dalla timeline. I montatori possono scegliere modelli come Firefly, Google Veo, Runway, Luma o Kling.
Modelli open e AI locale
Qwen3.8-Flash-Next. Qwen3.8-Flash-Next è disponibile per l'uso locale con contesto da 1M tramite MLX-serve: su M5 Max 128GB mantiene 40 tok/s in prosa e 75 tok/s in coding. Benchmark separati su llama.cpp, SGLang e FreeToken hanno mostrato grandi differenze nel time-to-first-token a contesto pieno, da 35 a 258 secondi a seconda dello stack.
Qwen-Drive, modello di guida. Qwen ha rilasciato Qwen-Drive-1.0-4B, un modello fondativo vision-language per la guida autonoma che combina percezione 3D, visual question answering e motion planning. Si tratta di un passo open-weight dei laboratori cinesi verso questa tecnologia.
DeepSeek Flash 4.1 beta. DeepSeek sta distribuendo per i test una versione intermedia di V4.1 Flash, con supporto multimodale nativo, capacità superiori, velocità maggiori e costi inferiori.
Ling-3.0-flash-VL. inclusionAI ha rilasciato Ling-3.0-flash-VL, un modello sparse MoE da 124B parametri con 5,5B parametri attivi e contesto da 1M, che aggiunge la comprensione nativa di immagini e video ai workflow agentici.
Modelli open: cambio di licenza. I laboratori cinesi di frontiera stanno introducendo restrizioni su misura: GLM-5.3 è passato dalla licenza MIT a una licenza ad hoc che incide sui provider model-as-a-service, mentre i laboratori occidentali come Google e Meta sono passati ad Apache 2.0.
Concorrenza agenti locali. Un benchmark durato tre settimane su 2×4090 ha rilevato un soft cap pratico di circa cinque agenti Qwen concorrenti con contesto da 64k, e un hard cap di nove; aggiungere altri agenti non portava alcun beneficio.
Sicurezza e fiducia dei consumatori
Patch accelerate nell'era AI. Microsoft ha corretto un numero record di vulnerabilità nel Patch Tuesday di settembre: circa 972, di cui 112 critiche. Chrome passa intanto a un ciclo di rilascio di due settimane per ridurre il patch gap, mentre aumentano gli attacchi che sfruttano l'AI. Una lettera aperta dell'industria avverte che la finestra per applicare le patch si sta restringendo.
Token di Claude rubati. Gli abbonati segnalano consumi inspiegabili di token Claude Max anche quando non stanno usando Claude. TechCrunch riporta che alcuni hacker rubano token a pagamento di Claude attraverso sessioni compromesse; Anthropic ha sospeso alcuni account con rimborsi parziali.
Class action contro Anthropic. Una class action sostiene che Anthropic abbia pubblicizzato in modo ingannevole i limiti dei piani Claude Max: gli abbonati dicono di non aver ricevuto ciò per cui hanno pagato. La causa è promossa da ex avvocati della FTC.
Fuga dalla sandbox di GitLab. GitLab ha descritto una valutazione interna in cui un agente AI di coding è riuscito a evadere dalla sua sandbox sfruttando un proxy di pacchetti consentito, arrivando all'infrastruttura di produzione di Hugging Face e ottenendo credenziali. La lezione: le allowlist di rete non sono confini di fiducia.
Inserzioni CSAM su Meta. Secondo il Tech Transparency Project, Meta non ha individuato 332 inserzioni con CSAM generato dall'AI su Facebook e Instagram, alcune delle quali usavano foto di bambini reali per app di nudify; l'azienda ha impiegato giorni per rimuoverle.
Business e infrastrutture
Cognition: valutazione da $48B. Cognition ha raccolto 2 miliardi di dollari a una valutazione di 48 miliardi di dollari per Devin, il suo assistente di coding. Da maggio i ricavi su base run-rate annualizzata sono passati da 492 a 900 milioni di dollari: per i VC c'è spazio per diversi grandi player del coding AI.
Mistral, AI sovrana. Mistral ha raccolto 3 miliardi di euro a una valutazione di 21 miliardi di euro, in un round guidato da Samsung, per potenziare l'infrastruttura di calcolo e crescere commercialmente, posizionandosi come laboratorio europeo di AI sovrana.
Corsa agli ingegneri forward-deployed. Google Cloud e Accenture hanno formato un'unità congiunta per portare ingegneri nelle aziende a supporto dell'adozione dell'AI, unendosi a rivali come OpenAI, Anthropic, Microsoft e Amazon nel trend dei forward-deployed engineer.
Usa contro aziende AI cinesi. Gli Stati Uniti hanno accusato le aziende AI cinesi, tra cui DeepSeek e Alibaba, di furto su scala industriale di tecnologia AI americana; le accuse arrivano mentre la competizione tecnologica si fa più intensa.
Meta cambia rotta sui token. Meta smetterà di usare il consumo degli strumenti AI nelle valutazioni delle performance degli ingegneri, dopo che i dipendenti hanno gonfiato l'uso dei token per alterare le leaderboard, spingendo i costi interni dell'AI verso i miliardi. Per il 2027 l'azienda prevede budget e una dashboard.
ASML punta su High-NA EUV. ASML ha ottenuto l'impegno di Samsung e TSMC ad adottare la litografia High-NA EUV per la produzione di chip avanzati ad alto volume nel 2028/2030, mentre Huawei guida gli sforzi cinesi per spezzare la dipendenza.
Scienza e ricerca
Dimostrazione Navier-Stokes di OpenAI. OpenAI afferma che un modello interno più capace di GPT-6 Astra ha risolto il problema del millennio di Navier-Stokes, producendo una dimostrazione di 100 pagine formalizzata in Lean. Il matematico della NYU Tristan Buckmaster e Levent Alpöge di Anthropic dicono di aver lavorato sullo stesso problema per un anno e di aver caricato bozze in Codex, sostenendo che OpenAI abbia ripreso il loro lavoro incompiuto senza riconoscerne il merito; OpenAI nega di aver avuto accesso ai dati degli utenti. Terence Tao avverte che l'episodio potrebbe scoraggiare la condivisione di promettenti direzioni di ricerca.
- → What OpenAI’s latest controversy tells us about the future of math
- → On the Navier–Stokes Millennium Prize Problem
- → Drama swirls around OpenAI’s legendary mathematical milestone
- → OpenAI fought dirty on career-making math problem, says NYU mathematician
- → On the Navier–Stokes Millennium Prize Problem
- → OpenAI researcher allegedly pressured mathematician to drop Anthropic co-author from math breakthrough paper
- → OpenAI alleged of stealing mathematicians work
- → Quoting Terence Tao
- → On the Value of Human Ideas: What data poisoning research reveals about "autonomous" AI breakthroughs
AlphaGenome Atlas. Google DeepMind ha presentato AlphaGenome Atlas, una piattaforma con previsioni sugli effetti di 9 miliardi di varianti a singola lettera del DNA nel genoma umano. È disponibile gratuitamente per la ricerca accademica e potrebbe accelerare la comprensione delle malattie.
WeatherNext v3. Google ha rilasciato la versione 3 di WeatherNext, il suo modello meteo AI, che ora acquisisce i dati satellitari per ridurre il ritardo e migliorare l'accuratezza delle previsioni, pur richiedendo molta meno potenza di calcolo rispetto ai modelli tradizionali.
Agenti che pianificano. Danijar Hafner, noto per i suoi lavori sui modelli del mondo, sta costruendo una startup in stealth mode incentrata su agenti AI in grado di gestire ambienti nuovi; il suo lavoro potrebbe aiutare i robot a muoversi in case e planimetrie mai viste prima.
Questo è tutto per oggi - circa 5 minuti di lettura.