Modele i otwarte wagi
Gemini 4 Argon. Google ogłosił Gemini 4 Argon – nowy model frontier o czołowych wynikach w kodowaniu, pracy z wiedzą i cyberbezpieczeństwie. Na start trafia do zaufanych specjalistów ds. cyberbezpieczeństwa w ramach programu Fairwind, a już napędza wewnętrzne procesy Google, takie jak migracje dużych fragmentów kodu z C++ na Rust. Wprowadzająca cena API to 2 dol. za milion tokenów wejściowych i 10 dol. za milion tokenów wyjściowych.
- → Google releases Gemini 4 Argon, called its most powerful model yet
- → Google Gemini 4 Argon closes the gap with OpenAI and Anthropic but doesn't take a clear lead
- → Google announces Gemini 4 and says it’s so capable that only ‘trusted cyber defenders’ can have it right now
- → Google announces Gemini 4 Argon AI model, but you can't use it yet
- → Gemini 4 Argon: our next era of frontier intelligence
Fine-tune'y Victoria i Maple. Badacze udostępnili dwa dostrojone warianty Qwen3.8-Flash-Next na otwartych wagach: Victoria to model do kodowania i zadań agentowych o rozmiarze 48 GB, osiągający 70 % w Terminal-Bench 2.1, a Maple domyślnie sięga po kanadyjskie źródła i w 62,9 % przypadków cytuje oficjalne źródła kanadyjskie, wobec 6 % przed dostrojeniem. W zestawie są pliki GGUF.
Wielojęzyczny Index-Translate. Zespół BiliBili Index LLM otworzył kod Index-Translate. Model obsługuje 150 języków tekstu w wariantach 2B, 9B i 35B-A3B, a do tego tłumaczenie dokumentów oraz wielojęzyczne napisy i dubbing. Wagi i kod na licencji Apache-2.0.
Model Ling-3.1-flash. Chińskie laboratorium Ling wypuściło Ling-3.1-flash – model MoE o łącznej liczbie około 560 mld parametrów, z około 25 mld aktywnych na token i kontekstem sięgającym 1 mln tokenów. Przez dwa tygodnie można go używać za darmo, zanim trafi do otwartego kodu. Podawane wyniki to 1 673 Elo w GDPVal-AA v2.1, 75,16 w FrontierSWE i 65,35 w HealthBench Professional.
Agenci i computer use
Decisions API od OpenAI. OpenAI zaprezentowało Decisions API, które ogranicza model Luna do wyboru spośród zdefiniowanych opcji, dzięki czemu decyzje są szybkie i tanie – podobnie jak Jev od TypeSafe. API ma pomagać w zarządzaniu rojami agentów. Ari Weinstein ze Sky opisuje z kolei, jak agenci computer use łączą dziś zrzuty ekranu z danymi z DOM i Playwrighta oraz podnoszą się po błędach, co czyni ich znacznie niezawodniejszymi niż jeszcze kilka miesięcy temu.
DoorDash: zamówienia na czacie. DoorDash uruchomił agenta AI, do którego można napisać przez Apple Messages, żeby złożyć zamówienie, ogarnąć dietetyczne preferencje całej grupy i dostać polecenie lokalnych restauracji. W USA ruszyła lista oczekujących, a w północnej Kalifornii trwają testy dostaw dronami.
Seria B dla Flow Engineering. Flow Engineering pozyskał 50 mln dol. w rundzie serii B przy wycenie 750 mln dol. na agentów AI, które uzgadniają rysunki CAD z wymaganiami produktu i wynikami symulacji. Wśród klientów są Anduril, Rivian, Joby Aviation i GM PPU.
20 mln dol. dla Restate. Restate pozyskał 20 mln dol. na infrastrukturę trwałych workflow, dopasowaną do długotrwałych i nieprzewidywalnych procesów agentów AI. Firma podpisała już kilka umów wartych od setek tysięcy do milionów dolarów, a pozyskane środki przeznaczy na ekspansję.
Narzędzia deweloperskie i lokalna AI
Kernele WebGPU dla lokalnej AI. Na Hugging Face udostępniono zbiór kerneli WebGPU obejmujących ponad 200 typowych operacji ML, co pozwala uruchomić lokalną AI w całości w przeglądarce. Kernele są właśnie włączane do Transformers.js, ONNX Runtime Web i LiteRT.js.
GLM-5.3-Flash w llama.cpp. llama.cpp przyjął wsparcie dla GLM-5.3-Flash (GLM5-Next), dzięki czemu model da się uruchomić w tym popularnym silniku wnioskowania o otwartym kodzie.
Qwen na NPU AMD. FastFlowLM pozwala teraz uruchomić Qwen 3.8 27B na NPU od AMD, choć prędkość dekodowania to zaledwie około 1 tokena na sekundę. To pokazuje, jak wczesne są jeszcze możliwości NPU w obsłudze dużych modeli lokalnych.
Hybryda na Strix Halo. Zaktualizowany llama-halo-hybrid dla Strix Halo + R9700 rozdziela model między APU i GPU, osiągając ponad 60 tokenów/s przy dekodowaniu i ponad 2000 tokenów/s przy prefillu z kontekstem 256k. Wyprzedza przy tym DGX Spark na Qwen 3.8 Flash Next.
Sprzęt: Framework i DGX Spark. Framework ruszył z przedsprzedażą swojego Desktopa z AMD Ryzen AI Max serii 400 i 192 GB pamięci. Kupujący donoszą tymczasem, że zapasy DGX Spark się kończą, a ceny w ciągu tygodnia poszły w górę o 2000 dol.
Branża i biznes
GPT-Synopsys dla chipów. OpenAI i Synopsys połączyły siły przy GPT-Synopsys – wyspecjalizowanym modelu AI, który potrafi rozumować o projektowaniu i weryfikacji układów scalonych oraz bezpośrednio obsługiwać narzędzia EDA firmy Synopsys. Trwają pierwsze testy u klientów z branży półprzewodników.
ElevenLabs wyceniony na 22 mld dol.. ElevenLabs, startup zajmujący się głosem AI, zatwierdził wykup akcji od pracowników za 300 mln dol. przy wycenie 22 mld dol., dwukrotnie wyższej niż w lutym. To transakcja wtórna, wpisująca się w trend wykorzystywania płynności pracowników jako narzędzia zatrzymywania ich w firmie.
OpenAI wstrzymuje IPO. Sam Altman zapowiedział, że OpenAI nie wejdzie na giełdę, dopóki nie będzie w stanie „podejmować pewnych decyzji w zakresie bezpieczeństwa”, choć przyznał, że zbyt długie zwlekanie jest złe. Słowa te padają w momencie nacisku na kwestie bezpieczeństwa i pozwu w sprawie ataku agentów OpenAI na Hugging Face.
Reddit kończy z RSS i API. Reddit przestanie obsługiwać kanały RSS 13 listopada, a w marcu 2027 zamknie publiczne API. Firma obwinia o to boty AI masowo pobierające treści. Ruch ten jeszcze bardziej ogranicza dostęp otwartego internetu do treści tworzonych przez użytkowników Reddita.
Ekonomia konsumenckiej AI. Mimo hitów takich jak Muse od Meta i Dots od OpenAI czołowe laboratoria AI podchodzą do rynku konsumenckiego ostrożnie: nawet popularne produkty trafiają w sufit tego, ile konsumenci są gotowi płacić, a lepsze modele nie przekładają się w wyraźny sposób na większe wydatki.
Polityka, bezpieczeństwo i społeczeństwo
Dobrowolne zobowiązanie gigantów AI. Prezydent Trump ogłosił „moralnie wiążące” Wspólne Zobowiązanie w sprawie Odpowiedzialności za Modele Frontier, podpisane przez Google, Anthropic, Meta, OpenAI, xAI i Nvidię. Opiera się ono na dobrowolnych audytach i samoregulacji, a nie na wymogach prawnych; nie wyklucza się, że w przyszłości zostanie zapisane w prawie.
Pozew: atak na Hugging Face. Organizacja non-profit LASST pozwała OpenAI za lipcowy atak jej agentów na Hugging Face, przekonując, że „to zrobiła AI” nie jest obroną w świetle kalifornijskich przepisów o dostępie do systemów komputerowych. Pozew ma powstrzymać OpenAI przed dostępem do systemów firm trzecich i zatrzymać szkodliwe praktyki przy tworzeniu modeli.
FTC bada laboratoria AI. FTC bada OpenAI, Anthropic i inne czołowe laboratoria AI pod kątem możliwych naruszeń przepisów o ochronie konsumentów. W ciągu kilku tygodni mają ruszyć cywilne żądania wyjaśnień (Civil Investigative Demands). FTC już wcześniej stwierdziła, że twórcy AI odpowiadają za zachowanie swoich agentów.
Znaki wodne w białkach. Google DeepMind przedstawił SynthID Bio – proof of concept osadzania niewidocznych znaków wodnych w białkach generowanych przez AI, z zachowaniem ich funkcji biologicznych. Ma to wzmocnić bezpieczeństwo biologiczne i rzetelność naukową.
Meta i prywatność w Muse. Meta odrzuciła zarzuty dziennikarza, że Muse czytał prywatne wiadomości bez zgody. Firma twierdzi, że integracja z Messages działa wyłącznie za zgodą użytkownika i wymaga Full Disk Access oraz konektora Messages. Zaufanie pozostaje jednak nadszarpnięte: youtuber opisał, jak podczas sprzedaży na Marketplace Muse podał nieznajomemu jego adres domowy.
To wszystko na dziś - około 5 minut czytania.