Premiery agentów i modeli
Wyniki Qwen 3.8 27B. Qwen 3.8 27B uzyskuje 52 punkty w Artificial Analysis Intelligence Index, dorównując GPT-5.6 Luna Max i jeden punkt za znacznie większymi GLM-5.2 i DeepSeek V4 Pro. Dostępny jest z domyślnym trybem rozumowania xhigh, prawdopodobnie w celu maksymalizacji widoczności w benchmarkach.
Kodowanie agentowe Qwen. Na 16 GB VRAM skwantowany Qwen 3.8 27B z dekodowaniem spekulatywnym MTP obsługuje kontekst 73k przy 30-50 tps. Lokalne benchmarki pokazują, że tryb średniego rozumowania niemal dorównuje DeepSeek V4 Flash przy mniejszej liczbie tokenów, podczas gdy xhigh nie poprawia wyraźnie kodowania agentowego.
- → Optimizing Qwen3.6 / Qwen3.8-27B on 16GB VRAM: Complete Benchmark Results and Setup Guide (~30-50tps at 32k to 72k context)
- → After pushing 1M+ tokens through Qwen 3.8 27B, here is my optimal llama.cpp config for 16GB VRAM (73k Context, Agentic Coding)
- → Local agentic coding Benchmark : Qwen 3.8 27B (in many weights quants / cache quants / engine / reasoning effort) vs others.
35B-A3B nadal niejasne. Deweloper Qwen mówi, aby nie czekać na 35B-A3B, mimo że zapotrzebowanie społeczności na 35B-A3B i 122B pozostaje wysokie, a brak oficjalnego sygnału premiery.
Szybkość Ling 3.0 Tiny. Ling 3.0 Tiny 8B z 1,3 mld aktywnych parametrów działa z prędkością 36 tokenów na sekundę na 4 GB VRAM i osiąga wyniki zbliżone do Qwen 3.5 9B i Gemma 12.
Dalszy trening GLM-5.3. Firma Z.ai wydała GLM-5.3, a poprawa wynika wyłącznie z większej ilości dalszego treningu, co daje lepszą wydajność w złożonym kodowaniu i zadaniach długoterminowych.
Agenci Grok Bot. Firma SpaceXAI wprowadziła Grok Bot, trwałe agenty AI na dedykowanych komputerach w chmurze, które obsługują wieloetapowe przepływy pracy, zapamiętują preferencje i koordynują działania w grupach.
Narzędzia i frameworki
llama.cpp v0.1.0. llama.cpp wydało pierwszą wersję semantyczną, v0.1.0, a PR dodaje adaptacyjne MTP, które dynamicznie wybiera głębokość MTP, poprawiając generowanie kodu o 10-15% i przyspieszając odzyskiwanie nawet o 100%.
Middleware płatności dla agentów. Middleware AgentCore Payments dla agentów LangChain dodaje deterministyczne budżety na poziomie sesji i obsługę portfela, a LangSmith rejestruje, co agenci kupili i dlaczego.
Agentowe funkcje fitness. Nowy artykuł argumentuje, że agentowe funkcje fitness mogą rozszerzyć architekturę ewolucyjną, obsługując ryzyka wymagające oceny, podczas gdy deterministyczne bramki pozostają dla mierzalnych niezmienników.
Planowanie GPU z uwzględnieniem ograniczeń. Hugging Face zbudowało alokator GPU uwzględniający ograniczenia, który na identycznym sprzęcie poprawił wykorzystanie nawet o 33 punkty procentowe, a wyniki ważone priorytetem nawet o 105%.
Przemysł i biznes
Umowa Stripe-OpenRouter. Stripe ma podobno przejąć startup routowania modeli AI OpenRouter za ponad 7 miliardów dolarów, po rundzie serii B o wartości 1,3 miliarda dolarów; OpenRouter ma 8 milionów użytkowników i 250 bilionów tokenów miesięcznie.
Skok przychodów Anthropic. Roczny wskaźnik przychodów Anthropic przekroczył 65 miliardów dolarów w lipcu, wzrastając z 47 miliardów dolarów w maju i 9 miliardów dolarów pod koniec 2025 roku, a IPO spodziewane jest tej jesieni przy wycenie ponad 2 biliony dolarów.
Relay zamyka działalność. Startup automatyzacji przepływów pracy AI Relay kończy działalność; jego założyciel i część personelu dołączają do zespołu Chrome w Google, aby pracować nad AI w Chrome.
Wispr pozyskuje 280 mln USD. Wispr pozyskał 280 milionów dolarów w rundzie serii B przy wycenie 2 miliardów dolarów, aby rozszerzyć działalność z dyktowania AI na notatki i spotkania, wprowadzając model Canto.
Odbicie rynku wideo AI. Wideo generowane przez AI przyciąga studia z Hollywood i miliardy po fałszywym starcie Sory, a startupy takie jak Promise używają Seedance 2.5 do tła w czasie rzeczywistym.
Agenci AI Grabu. Grab zmniejszył mechaniczną pracę analityczną z 44% do 30% dzięki pięciopoziomowemu modelowi autonomii agentów, przy czym analitycy zachowują ostateczne decyzje.
Infrastruktura i obliczenia
Centrum danych OpenAI w Ohio. OpenAI podpisało 20-letnią umowę najmu na 8 GW mocy IT w PORTS-Pike w Ohio z SB Energy; Nvidia wspiera do 105 miliardów dolarów i jest wyłącznym dostawcą układów.
Groq zmienia kierunek na neocloud. Groq pozyskał 350 milionów dolarów przy wycenie 3,5 miliarda dolarów, przechodząc z układów AI na obsługę infrastruktury neocloud opartej na Nvidii po umowie licencyjnej z Nvidią.
Skok cen RTX Pro 6000. CDW podniósł sugerowaną cenę detaliczną RTX Pro 6000 z 16 do 19 999 dolarów, a ceny na rynku wtórnym również rosną, co ogranicza lokalnych twórców AI.
Dane treningowe i polityka
Skanowanie rzadkich książek przez Amazon. Znacznik AirTag namierzył masowe zamówienie rzadkich książek do centrum treningowego AI Amazona, gdzie pracownicy niszczą książki, aby je zeskanować; Amazon twierdzi, że kupuje książki kanałami komercyjnymi.
Znakowanie wodne Claude Anthropic. Anthropic będzie osadzać znaki wodne SynthID-Text w wynikach Claude, aby spełnić wymogi unijnego aktu o AI; krytycy obawiają się jakości doboru słów i problemów z przejrzystością.
To wszystko na dziś - około 5 minut czytania.