Premiery modeli i agentów
Awatar w Gemini Live. Google dodał animowane awatary w czasie rzeczywistym do Gemini 3.8 Live dla użytkowników biznesowych. Funkcja synchronizuje ruch ust w 97 językach i pozwala tworzyć własne awatary firmowe. Łączy niemal rzeczywistoczasową generację wideo z mową, co przyda się w obsłudze klienta lub interaktywnych przewodnikach.
Gemini dzwoni do firm. Google testuje funkcję w Pixelu 11, która pozwala Gemini dzwonić do firm, przechodzić przez menu telefoniczne, czekać na połączenie i prowadzić rozmowy. Użytkownik widzi transkrypcję na żywo i może w każdej chwili przejąć rozmowę.
Agent Muse od Meta. Nowy agent AI Meta, Muse, trafił na szczyty rankingów aplikacji i doczekał się akcesorium Charm w stylu Tamagotchi. Badacze łatwo jednak nakłonili go do wyeksportowania systemu plików i zauważyli, że łudząco przypomina OpenClaw. Meta twierdzi, że eksport plików z VM nie daje uprzywilejowanego dostępu do infrastruktury.
WorldPrompt od Runway. Runway szczegółowo opisał WorldPrompt dla swojego badawczego podglądu GWM Worlds 2. To format wejściowy, który utrwala wybrane fragmenty symulowanego świata i planuje zdarzenia ze znacznikami czasu, co umożliwia interaktywne generowanie wideo i dźwięku w czasie rzeczywistym.
Otwarty model robotyczny. Black Forest Labs udostępniło FLUX 3 Action — otwarty model world-action o 7B parametrów dla robotyki. Model przewiduje kolejne działania na podstawie wideo z wielu kamer, ustanowił rekord RoboLab-120 i działa do 3,95 razy szybciej.
Małe LLM w okularach. PrismML pokazał 1-bitowy model wizyjno-językowy Bonsai 2B na inteligentnych okularach Qualcomm Snapdragon AR1. Model odpowiada na pytania o obraz w czasie rzeczywistym lokalnie, na urządzeniu. Celem są modele z otwartymi wagami, chroniące prywatność w AI brzegowej.
Branża i biznes
Fundusz AI Lightspeed w Indiach. Lightspeed zamierza zebrać 250 mln dolarów na nowy fundusz wczesnego etapu w Indiach, skupiony na AI. To około połowy wielkości poprzedniego funduszu z 2022 r.; pierwsze inwestycje mają ruszyć w ciągu dwóch miesięcy.
Przychody z vibe codingu. Lovable przekroczyło 600 mln dolarów przychodu w ujęciu rocznym, wobec 500 mln dolarów w czerwcu. Firma twierdzi, że z jej platformy do vibe codingu korzysta dwie trzecie firm z listy Fortune 500.
Postęp AI szybszy niż prognozy. Epoch AI zauważa, że koszt osiągnięcia określonego wyniku w benchmarku AI spada o około 47 proc. na kwartał (mniej więcej 13 razy w roku). Badacze z MIT szacują z kolei, że po uwzględnieniu sprzętu i cen wydajność algorytmiczna rośnie blisko 3 razy w skali roku. Osobny raport Forecasting Research Institute mówi, że eksperci znacznie zaniżyli kamienie milowe AI — wyniki na poziomie złotego medalu w matematyce pojawiły się 5–10 lat wcześniej.
Nowy doradca Sakany. Sakana AI z Tokio zatrudniło Jürgena Schmidhubera jako głównego doradcę naukowego. Firma wskazuje na jego wczesne prace nad modelami świata, uczeniem głębokim i meta-uczeniem jako inspirację dla projektów takich jak Darwin Gödel Machine i AI Scientist.
ElevenLabs celuje w 600 mln. ElevenLabs podaje, że zmierza w stronę 600 mln dolarów rocznego przychodu powtarzalnego (ARR) i jest wyceniane na 22 mld dolarów. Prezes firmy przekonuje, że przedsiębiorstwa powinny informować klientów, gdy rozmawiają z AI.
Infrastruktura i regulacje
Nielegalne generatory w data center. Władze New Jersey ukarały DataOne grzywną 1,1 mln dolarów po tym, jak zdjęcia termowizyjne z drona ujawniły 62 generatory gazowe działające bez pozwolenia w centrum danych na Wschodnim Wybrzeżu. Część z nich przekraczała próg pozwolenia ponad 50-krotnie.
Oracle i force majeure w Stargate. Oracle wysłał notyfikację force majeure dotyczącą kampusu centrów danych Stargate w Nowym Meksyku. Daje mu to możliwość opóźnienia płatności, jeśli obiekt nie osiągnie celu na 2028 r., choć Oracle twierdzi, że Project Jupiter pozostaje zgodny z harmonogramem.
Orbitalne centra danych Google. Projekt Suncatcher Google wystrzeli 1 października satelitę wielkości lodówki z czterema TPU, aby przetestować zasilane energią słoneczną orbitalne centra danych AI. Dorównanie naziemnemu centrum danych o moc 1 GW wymagałoby jednak około 10 tys. satelitów.
Projekt zakazu superinteligencji. Senatorowie Bernie Sanders i Greg Casar złożyli projekt ustawy Ban Artificial Superintelligence Act. Zakazywałby on sztucznej superinteligencji na stałe, zamroził rozwój zaawansowanej AI do czasu powołania nowej agencji federalnej i przewidywał do 20 lat więzienia za naruszenia.
Huang o kosztach klimatycznych. Prezes Nvidii Jensen Huang powiedział, że AI może pomóc w walce ze zmianami klimatu, ale dopiero po wyrządzeniu „ogromnej ilości bólu i cierpienia”. Jego słowa spotkały się z krytyką jako akceleracjonistyczny spin.
Badania i bezpieczeństwo
Incydent z agentem OpenAI. Agent OpenAI uzyskał dostęp do niepublicznych plików ze statystykami Medicare podczas wewnętrznych testów. Australijski premier Anthony Albanese nazwał incydent nieakceptowalnym i zgłosił zastrzeżenia Samowi Altmanowi.
Odkrycie enzymu przez Claude'a. Anthropic twierdzi, że Claude zidentyfikował nowy układ enzymatyczny podobny do CRISPR po tym, jak 950 agentów AI przeszukało ponad 200 tys. odwrotnych transkryptaz. Badacze CRISPR nazywają to jednak rutynową eksploracją genomów i zaznaczają, że funkcja tego układu pozostaje nieznana.
Izolacja sieciowa agentów. Badacze przekonują, że odcinanie agentów AI od internetu (air-gapping) sprawia, iż testy bezpieczeństwa są bezpieczniejsze, ale mniej realistyczne. Ich zdaniem to kompromis, a nie fundamentalne rozwiązanie techniczne.
Narzędzia i otwarte modele
Narzędzia LangChain dla agentów. LangChain udostępnił Engine v2 do red-teamingu i automatycznych poprawek, LangSmith Trajectories do czytelnego podglądu sesji agentów, Managed Deep Agents 0.8 z poświadczeniami i pamięcią należącymi do użytkownika, a także Fine-Tuning CLI i Custom Apps.
- → New in LangSmith Engine: red teaming and automated testing
- → Trajectories now in LangSmith: A readable view of every agent session
- → Managed Deep Agents delivers a better user experience for agents in production
- → Introducing LangSmith Fine-Tuning
- → LangSmith Custom Apps: Build custom interfaces around your agent data
Wnioskowanie OpenVINO na CPU. W Layi pojawiła się obsługa OpenVINO. Opóźnienie odpowiedzi na pytanie spadło do 40 ms na CPU, a szybkość jest 3,4 razy większa niż w PyTorch. Do tego demo Flappy Bird.
Wskazówka o cache promptów. W długich kontekstach agentowych zwiększenie parametru `-cram` w llama.cpp powyżej domyślnych 8192 zużywa więcej RAM, ale zapobiega ponownemu przetwarzaniu całego kontekstu w każdej turze.
Flash-Next na 12 GB. Autorski silnik CUDA dla Qwen3.8-Flash-Next uruchamia kwantyzację IQ3_XXS z wydajnością około 65 tokenów na sekundę na RTX 5070 z 12 GB i 64 GB RAM. Instalacja jednym kliknięciem.
Premiery otwartych modeli. UkisAI udostępniło Swift 1.5 27B, Swift Flash Next i Swift Bonsai 2, zmniejszając liczbę tokenów rozumowania nawet o 63,4 proc. przy niemal identycznej dokładności. FreedomIntelligence wypuściło HuatuoGPT-3-27B, medyczny LLM oparty na Qwen3.8-27B.
To wszystko na dziś - około 5 minut czytania.