Agentic AI News Dzisiaj

Wiadomości o agentach AI dnia w jednym 5-minutowym czytaniu: premiery, narzędzia, badania, finansowanie i ruchy korporacyjne.

Aktualizowane codziennie wybrane z 30 źródeł Sobota, Październik 3, 2026

Premiery agentów i modeli

Gadżety Muse. Meta udostępniła na otwartej licencji firmware i SDK do samodzielnej budowy sprzętu współpracującego z jej agentem Muse — m.in. wyświetlaczy E Ink i sticków HDMI. Wsparcie zapewnia Discord.

Dot od OpenAI. Nowy agent Dot od OpenAI zachowuje się jak oprogramowanie klasy enterprise, które przy okazji zamówi obiad. Działa w maszynie wirtualnej z dostępem do aplikacji takich jak Blender i GIMP, a OpenAI pozycjonuje go jako współpracownika, a nie osobistego asystenta od zakupów.

Model Unitree. Unitree wydało UnifoLM-WLA-1.0 — model 6B trenowany na ok. 2500 godzinach danych z prawdziwych robotów. Na G1 obsługuje 64 zadania, od pracy całym ciałem po zadania stołowe, łącząc optical flow z MMDiT do sterowania ciągłego.

FrogNano do kodu. FrogNano-4B-2609 od Microsoftu to model agentowy wywodzący się z Qwen3.5-4B. Dotrenowano go na 1500 syntetycznych zadaniach SWE z wykonywalnymi nagrodami (executable rewards), żeby poprawić inżynierię oprogramowania na poziomie repozytorium w kompaktowej formie.

Cloudflare Clef. Cloudflare udostępniło modele decyzyjne Clef i Clef-flash, które zwracają prawdopodobieństwa dla zdefiniowanych odpowiedzi. Mediana opóźnienia wynosi zaledwie 39 ms, co pozwala agentom działać bez człowieka w pętli.

Narzędzia i frameworki

Silnik MegaCapybara. Dedykowany silnik inferencji dla RTX 5090 i Qwen3.8 27B ma być około dwukrotnie szybszy w dekodowaniu niż NInfer: ponad 500 t/s dla pojedynczego zapytania i ponad 2000 t/s przy 12 agentach, dzięki dynamicznym kernelom i zarządzaniu cache.

Nowości w llama.cpp. W llama.cpp pojawiło się wsparcie dla modeli decyzyjnych oraz pull request do CUDA, który łączy współdzielonych ekspertów i przyspiesza architektury MoE, takie jak Qwen 35B A3B.

mlsubgen do napisów. Nowe lokalne narzędzie generuje napisy w 45 językach w całości na własnym komputerze: wykrywa język w poszczególnych fragmentach, uzgadnia wyniki dwóch modeli rozpoznawania mowy za pomocą lokalnego LLM-a i sięga po napisy już wbudowane w plik, jeśli są dostępne.

Badania i postępy w modelach

Architektura Spotlight. Spotlight od Percepty zastępuje attention nieograniczoną, zapisywalną pamięcią, którą model sam indeksuje. Rozdziela w ten sposób inteligencję od wiedzy, dzięki czemu możliwości mogą rosnąć bez zmiany wag.

Nowości GPT-6. OpenAI opublikowało przewodnik po rodzinie GPT-6 i zapowiedziało nowości z DevDay: GPT-6.1 Sol, computer use w Agents API, środowiska Codex w chmurze oraz Decisions API.

AstaBrief na otwartej licencji. Hugging Face udostępniło na otwartej licencji AstaBrief — mały model trenowany specjalnie do szybkiego generowania raportów naukowych z cytowaniami, zaprojektowany tak, by trzymać się źródeł i weryfikować własne wyniki.

Branża i biznes

Apple zaostrza Full Disk Access. Apple dodaje mechanizmy kontroli do Full Disk Access w macOS ze względu na ryzyko związane z agentami AI. Powodem są doniesienia, że Meta Muse miał czytać wiadomości bez zgody użytkownika. Meta twierdzi, że dostęp działa tylko za zgodą, a Apple chce wyraźnego działania ze strony użytkownika.

Sprzeciw wobec centrów danych. Amazon zadeklarował 1 mld dolarów dla społeczności wokół centrów danych, a szef AWS Matt Garman zaapelował o zniesienie moratoriów, przekonując, że stoją za nimi zagraniczne dezinformacje. Microsoft z kolei rozwija biomimikrę w centrach danych w obliczu lokalnego sprzeciwu.

AI jako super intelligence. Biały Dom skłonił szefów największych firm technologicznych do podpisania deklaracji o bezpieczeństwie AI, a Trump podpisał rozporządzenie wykonawcze, które przemianowuje AI na „super intelligence”. Tymczasem tylko 2 proc. konsumentów kupuje produkty AI.

Wstrząs w OpenAI. OpenAI zwolniło trzech badaczy, a czwarty odszedł po tym, jak wewnętrzne śledztwo wykazało, że przekazali poufne informacje zewnętrznej organizacji zajmującej się bezpieczeństwem AI.

Uber skraca czas wyszukiwania. Uber przebudował pipeline wyszukiwania i skrócił opóźnienie end-to-end o 50 proc., wykorzystując agentowe kodowanie do wskazania i weryfikacji optymalizacji.

AI od środka w Airbnb. CTO Airbnb Ahmad Al-Dahle stosuje strategię AI od środka na zewnątrz: najpierw wykorzystać generatywną AI wewnętrznie, żeby przyspieszyć rozwój produktu, a potem przekształcić doświadczenie klienta.

Lokalna AI i sprzęt

Strata z Qwen3.8 Next. Użytkownicy donoszą, że Strata z Qwen3.8 Next działa z prędkością 45–70 t/s na wolnym DDR4 z 7900XTX i 150–200 t/s na ograniczonym mocowo RTX 5090 z 96 GB DDR5 — znacznie szybciej niż llama.cpp.

iPhone jako druga GPU. iPhone 17 Pro Max potrafi przyspieszyć prefill Qwen 3.8 27B o 29–44 proc. na MacBooku z 24 GB pamięci, jeśli jest podłączony przez USB-C, a górne warstwy działają na GPU telefonu.

Karty Ascend 96 GB. Dwie karty Huawei Atlas 300I Duo po 96 GB każda pozwalają uruchomić Qwen3.8 Flash-Next z prędkością ok. 30 t/s po dostrojeniu stosu oprogramowania — choć nie da się ich użyć jako bezpośredniego zamiennika CUDA.

DGX Spark i ceny 5090. Nvidia wprowadziła 64 GB wersję DGX Spark, a cena pierwotnego modelu 128 GB wzrosła do 6950 dolarów. Jak donoszą użytkownicy, zakup RTX 5090 w Micro Center wymaga teraz podpisania dokumentów o braku eksportu.

To wszystko na dziś - około 5 minut czytania.

Czytaj go każdego ranka, prosto w przeglądarce

Rozszerzenie otwiera to podsumowanie w panelu bocznym Chrome — jeden klik, bez konta.

Dodaj do Chrome — za darmo