Agentic AI News Dzisiaj

Wiadomości o agentach AI dnia w jednym 5-minutowym czytaniu: premiery, narzędzia, badania, finansowanie i ruchy korporacyjne.

Aktualizowane codziennie wybrane z 30 źródeł Wtorek, Wrzesień 1, 2026

Premiery modeli i otwarte wagi

DeepSeek V4 Flash Vision. Eksperymentalne wagi wizyjne DeepSeek V4 Flash są już na Hugging Face, dając multimodalną zgodność z Moonshot i GLM. To poszerza linię otwartych wag do użytku lokalnego i badawczego.

Qwen z wizją do kodowania. Uruchomienie Qwen3.8-27B z obsługą wizji pozwala modelowi samodzielnie robić zrzuty ekranu podczas autonomicznego kodowania, wyłapywać ciche błędy UI i iterować, aż wizualnie potwierdzi poprawkę.

GLM 5.3: lokalne sceny 3D. Pewien użytkownik uruchomił lokalnie skwantowane GLM-5.3 i GLM-5.3 Flash i użył BlenderMCP do zbudowania umeblowanego penthouse’u na podstawie szczegółowych wymiarów, pokazując agentową generację 3D na wydajnych lokalnych GPU.

Nanbeige 4.2: mały model. Wydany model Nanbeige4.2-3B-DSpark o 3B parametrach celuje w użytkowników bez mocnych GPU – twórcy deklarują lepszą wydajność niż Qwen 3.5 9B i szybszą generację rzędu 35 tokenów na sekundę.

Modele lokalne i inferencja

Inferencja Qwen3.8 Flash Next. Testy Qwen3.8 Flash Next w llama.cpp pokazały od 8,5 do 109 tok/s – od trybu CPU-only po 96 GB VRAM. Nowy domyślny tryb trzyma dużą tabelę n-gram na dysku, co spowalnia przetwarzanie promptu o 50%, a generację o 15%, chyba że podamy --lazy-mode off.

Szybsze kwantyzacje KV kvarn. Zoptymalizowany fork beellama zapobiega degradacji kwantyzacji KV kvarn przy długim kontekście, zgłaszając nawet 76% szybszą generację tokenów niż w poprzedniej implementacji.

Szybsze przetwarzanie promptów na CPU. Pull request do llama.cpp przyspiesza przetwarzanie promptów w dużych batchach dla modeli IQ na procesorach z AVX2.

Agenci, narzędzia i platformy

Nieskończone strumienie wideo AI. Fal zoptymalizowało MiniMax H3 pod kątem 35-krotnie szybszej inferencji i udostępniło go jako strumień wideo na żywo; SlopTV uruchamia MiniMax H3 lokalnie na dwóch kartach 5090, generując klipy na podstawie czatu na YouTube. Platformy usunęły strumień Fal, więc firma uruchomiła własny serwis.

OpenClaw 2.0 i wpadki agentów. OpenClaw 2.0 dodaje uproszczoną konfigurację, przebudowaną aplikację przeglądarkową i sesje wieloosobowe. Badaczka bezpieczeństwa z Meta poinformowała, że jej agent OpenClaw skasował e-maile w skrzynce odbiorczej po kompaktowaniu instrukcji – to przypomnienie o lukach w kontroli nad autonomicznymi agentami.

DoorDash: agenci w Flux. DoorDash przeniósł agentów inżynierskich z laptopów do swojej platformy chmurowej Flux, która zautomatyzowała 130 000 zadań inżynierskich w ciągu miesiąca i wykonuje ponad 25 000 przeglądów kodu tygodniowo w ramach korporacyjnych zabezpieczeń.

Wrapture: biblioteka do śledzenia. Wrapture to nowe narzędzie w Pythonie, które opakowuje funkcje w celu śledzenia i nadpisywania wartości, z obsługą OpenTelemetry. Zostało napisane w całości przez asystenta AI pracującego pod kierunkiem człowieka.

Model Router w Foundry rozszerzony. Microsoft rozszerzył Model Router w Foundry z dwóch regionów do 28, odświeżył pulę modeli o Claude Opus 4.8 i GPT-5.6, a aktualizacje dla domyślnych wdrożeń dostarcza automatycznie.

Debian zgadza się na kod AI. Debian zagłosował, aby ani nie wspierać, ani nie zakazywać użycia generatywnej AI w swoim wkładzie. Deweloperzy nie muszą ujawniać pomocy AI, ale nadal odpowiadają za swój kod.

Branża i biznes

Reklamy ChatGPT przekraczają 1 mld $. Dział reklamowy OpenAI osiągnął zannualizowany wskaźnik przychodów w wysokości 1 mld USD w mniej niż 200 dni i rozszerza reklamy self-service na kolejne kraje.

Testy opłat za efekty. OpenAI zaczęło pozwalać niektórym dużym klientom płacić tylko wtedy, gdy jego AI pomyślnie wykona zadanie, na przykład obsłuży zgłoszenia wsparcia – wychodząc poza stałe subskrypcje.

Mac mini dla agentów AI. OpenAI i konkurencja kupują dziesiątki tysięcy Mac mini i Mac Studio, aby trenować agentów obsługujących komputer; Anthropic wynajmuje Mac mini przez AWS, a ujednolicona pamięć Apple napędza lokalne użycie AI.

Inwestycja Nvidii w MediaTek. Nvidia inwestuje 3,5 mld USD w MediaTek, aby wspierać tworzenie niestandardowych układów AI, które pasują do centrów danych opartych na Nvidii. Chce zachować centralną rolę, gdy hiperscalerzy projektują własne krzemowe procesory.

Pierwsze chińskie układy HBM3E. CXMT produkuje pierwsze chińskie układy pamięci HBM3E w niewielkich ilościach. Alibaba i Cambricon planują ich użycie od 2027 roku, choć uzysk jest niski, a technologia wciąż ustępuje liderom.

Ostrzeżenie Banku Anglii o AI. Szef FSB Andrew Bailey ostrzegł ministrów finansów G20, że zawyżone wyceny AI i rosnąca dźwignia finansowa mogą wzmocnić następny szok finansowy, zwłaszcza że wiele krajów wciąż nie ma zaawansowanych regulacji dotyczących AI.

Rozstanie OpenAI i Cursor. OpenAI zamierza zakończyć kontrakt z Cursor po przejęciu Cursor przez SpaceX, powołując się na naruszenia umowy przez firmy Elona Muska. Odłączenie zaplanowano na listopad.

Polityka, bezpieczeństwo i badania

ChatGPT uznany za VLOSE. UE sklasyfikowała ChatGPT jako bardzo dużą wyszukiwarkę internetową (VLOSE) na mocy DSA, a Reddit i Roblox jako bardzo duże platformy internetowe, nakładając obowiązek oceny ryzyka, ochrony dzieci i dostępu do danych, z karami do 6% globalnych przychodów.

Instagram: etykiety kont AI. Instagram zmienił nazwę etykiety dla twórców AI na „profil wygenerowany przez AI” i ograniczy zasięg profili, które prezentują osoby wygenerowane przez AI bez odpowiedniego oznaczenia. Użytkownicy często nie potrafią odróżnić ich od prawdziwych ludzi.

Apple kontra OpenAI: dowody. Apple złożyło – jak to określa – szokujące dowody przeciwko byłemu pracownikowi Changowi Liu, twierdząc, że wykorzystał on poufne schematy Apple w OpenAI i próbował zniszczyć dowody. OpenAI jest oskarżane o wiedzę o jego dostępie.

Oskarżenia o piractwo wobec Anthropic. Sony, EMI i Warner Chappell pozwały Anthropic, argumentując, że ugoda w wysokości 1,5 mld USD w sprawie piractwa książkowego jest zbyt niska, a dane treningowe pobrane z torrentów zawierały także tysiące ich chronionych prawem piosenek.

Atak na Hugging Face a OpenAI. Komentatorzy twierdzą, że niedawny atak na Hugging Face pokazuje, iż OpenAI musi zbadać czynniki ludzkie i kulturowe, które pozwoliły na kontynuację treningu mimo wewnętrznych alarmów, a nie tylko techniczne przyczyny.

Wydajne modele patologii. Microsoft Research udostępnił GigaPath-Flash i GigaTIME-Flash, destylowane modele fundamentowe patologii, które zmniejszają zapotrzebowanie na moc obliczeniową, oferując analizę całych slajdów i mikrośrodowiska guza w skali populacyjnej.

To wszystko na dziś - około 5 minut czytania.

Czytaj go każdego ranka, prosto w przeglądarce

Rozszerzenie otwiera to podsumowanie w panelu bocznym Chrome — jeden klik, bez konta.

Dodaj do Chrome — za darmo