Rilasci di agenti e modelli
Punteggi di Qwen 3.8 27B. Qwen 3.8 27B ottiene 52 sull'Artificial Analysis Intelligence Index, eguagliando GPT-5.6 Luna Max e un punto dietro a modelli molto più grandi come GLM-5.2 e DeepSeek V4 Pro. Viene fornito con ragionamento xhigh predefinito, probabilmente per massimizzare la visibilità nei benchmark.
Coding agentico di Qwen. Su 16 GB di VRAM, il Qwen 3.8 27B quantizzato con decodifica speculativa MTP gestisce un contesto di 73k a 30-50 tps. I benchmark locali mostrano che la modalità di ragionamento media quasi eguaglia DeepSeek V4 Flash con meno token, mentre xhigh non migliora chiaramente il coding agentico.
- → Optimizing Qwen3.6 / Qwen3.8-27B on 16GB VRAM: Complete Benchmark Results and Setup Guide (~30-50tps at 32k to 72k context)
- → After pushing 1M+ tokens through Qwen 3.8 27B, here is my optimal llama.cpp config for 16GB VRAM (73k Context, Agentic Coding)
- → Local agentic coding Benchmark : Qwen 3.8 27B (in many weights quants / cache quants / engine / reasoning effort) vs others.
35B-A3B ancora incerto. Uno sviluppatore di Qwen dice di non aspettare 35B-A3B, anche se la richiesta della comunità per 35B-A3B e 122B rimane alta senza segnali ufficiali di rilascio.
Velocità di Ling 3.0 Tiny. Ling 3.0 Tiny 8B con 1,3 miliardi di parametri attivi gira a 36 token/sec su 4 GB di VRAM e offre prestazioni simili a Qwen 3.5 9B e Gemma 12.
Post-training di GLM-5.3. Z.ai ha rilasciato GLM-5.3 con miglioramenti derivanti esclusivamente da ulteriore post-training, che offrono migliori prestazioni nel coding complesso e nei task a lungo orizzonte.
Agenti di Grok Bot. SpaceXAI ha presentato Grok Bot, agenti AI persistenti su computer cloud dedicati che gestiscono flussi di lavoro multi-step, ricordano le preferenze e si coordinano in gruppi.
Strumenti e framework
llama.cpp v0.1.0. llama.cpp ha rilasciato la sua prima versione semantica, v0.1.0, e una PR aggiunge MTP adattivo che sceglie dinamicamente la profondità di MTP, migliorando la generazione di codice del 10-15% e il recall fino al 100% più veloce.
Middleware di pagamento per agenti. Il middleware AgentCore Payments per gli agenti LangChain aggiunge budget deterministici a livello di sessione e supporto per wallet, con LangSmith che registra cosa hanno acquistato gli agenti e perché.
Funzioni di fitness agentiche. Un nuovo articolo sostiene che le funzioni di fitness agentiche possano estendere l'architettura evolutiva gestendo rischi che richiedono giudizio, mentre i gate deterministici rimangono per invarianti misurabili.
Scheduling GPU sensibile ai vincoli. Hugging Face ha costruito un allocatore GPU sensibile ai vincoli che ha migliorato l'utilizzo fino a 33 punti percentuali e l'output ponderato per priorità fino al 105% su hardware identico.
Industria e business
Accordo Stripe-OpenRouter. Secondo quanto riportato, Stripe acquisirà la startup di routing di modelli AI OpenRouter per più di 7 miliardi di dollari, dopo il suo round di serie B da 1,3 miliardi; OpenRouter ha 8 milioni di utenti e 250 trilioni di token al mese.
Impennata dei ricavi di Anthropic. Il tasso di ricavi annualizzato di Anthropic ha superato i 65 miliardi di dollari a luglio, in aumento rispetto ai 47 miliardi di maggio e ai 9 miliardi di fine 2025, con IPO prevista quest'autunno a una valutazione di oltre 2 trilioni di dollari.
Relay chiude. La startup di automazione dei flussi di lavoro AI Relay sta chiudendo; il suo fondatore e alcuni membri dello staff si uniscono al team Chrome di Google per lavorare sull'AI in Chrome.
Wispr raccoglie 280 milioni di dollari. Wispr ha raccolto 280 milioni di dollari in un round di serie B con una valutazione di 2 miliardi di dollari per espandersi dalla dettatura AI alla presa di appunti e alle riunioni, lanciando il modello Canto.
Rimbalzo del mercato dei video AI. I video generati dall'AI stanno attirando gli studi di Hollywood e miliardi di dollari dopo il falso inizio di Sora, con startup come Promise che usano Seedance 2.5 per sfondi in tempo reale.
Gli agenti AI di Grab. Grab ha ridotto il lavoro di analisi meccanica dal 44% al 30% utilizzando un modello di autonomia degli agenti a cinque livelli, con gli analisti che mantengono le decisioni finali.
Infrastruttura e calcolo
Data center di OpenAI in Ohio. OpenAI ha firmato un contratto di locazione ventennale per 8 GW di capacità IT a PORTS-Pike in Ohio con SB Energy; Nvidia sostiene fino a 105 miliardi di dollari ed è l'unico fornitore di chip.
Pivot neocloud di Groq. Groq ha raccolto 350 milioni di dollari con una valutazione di 3,5 miliardi, mentre si sposta dai chip AI all'infrastruttura neocloud basata su Nvidia dopo un accordo di licenza con Nvidia.
Impennata del prezzo di RTX Pro 6000. CDW ha aumentato il prezzo consigliato di RTX Pro 6000 da 16.000 a 19.999 dollari, e anche i prezzi del mercato dell'usato stanno salendo, mettendo in difficoltà i costruttori AI locali.
Dati di addestramento e policy
Scansione di libri rari di Amazon. Un AirTag ha tracciato un ordine all'ingrosso di libri rari fino a una struttura di addestramento AI di Amazon, dove i lavoratori distruggono i libri per scansionarli; Amazon dice di acquistare i libri attraverso canali commerciali.
Watermarking di Anthropic Claude. Anthropic incorporerà filigrane SynthID-Text nell'output di Claude per conformarsi all'AI Act dell'UE; i critici temono problemi di qualità nella scelta delle parole e problemi di trasparenza.
Questo è tutto per oggi - circa 5 minuti di lettura.