Agentic AI News Dzisiaj

Wiadomości o agentach AI dnia w jednym 5-minutowym czytaniu: premiery, narzędzia, badania, finansowanie i ruchy korporacyjne.

Aktualizowane codziennie wybrane z 30 źródeł Czwartek, Sierpień 13, 2026

Premiery modeli i agentów

Grok 4.6 i Grok Bot. SpaceXAI wydało Grok 4.6, który dorównuje GPT-5.6 Sol od OpenAI i pozostaje w tyle jedynie za Claude Opus 5 w indeksie Artificial Analysis, obniżając przy tym ceny na poziomie frontier, oraz wprowadziło Grok Bota – zawsze aktywnego asystenta AI, który działa z własnego komputera w chmurze, by realizować powierzone zadania.

Qwen 3.8 duży i mały. Qwen3.8-2.4T-A95B jest już dostępny, a strona Qwen3.8 z wersją 27B pojawiła się na krótko na ModelScope, zanim została usunięta, co wskazuje na rychłe wydanie. Entuzjaści lokalnego uruchamiania już planują podział sprzętu dla modelu 2.4T.

Aktualizacja DeepSeek V4 Pro. Model DeepSeek V4 Pro 0813 jest dostępny przez API na OpenRouter, bez oficjalnej strony ogłoszenia; otwarte wagi są prawdopodobne, biorąc pod uwagę wcześniejsze wydania. Jego sposób rozumowania wyraźnie różni się w zależności od niskiego, średniego i wysokiego poziomu rozumowania.

Modele wizyjne edge. LFM2.5-VL-3B od Liquid AI zapewnia znacznie lepsze powiązanie z interfejsem użytkownika i może działać na telefonach, natomiast North Micro Vision od Cohere (Apache-2.0) oferuje natywną obsługę obrazów w kompaktowym pakiecie z 2,4 mld parametrów.

Bilionowy model Nvidii. Firma Nvidia podobno buduje Nemotron 4 z co najmniej bilionem parametrów i potraja wydatki na trenowanie w chmurze do 28 miliardów dolarów do 2031 roku, mając na celu konkurowanie z chińskimi modelami o otwartych wagach.

Rozwój agentów i narzędzi

Zarządzane agenty i BYOC. LangChain wprowadził Managed Deep Agents jako kolejny krok po frameworkach i udostępnił ogólnie LangSmith BYOC na AWS, umożliwiając przedsiębiorstwom przechowywanie śladów agentów i danych we własnej sieci VPC.

Aplikacja ChatGPT na Linuksa. OpenAI wydało aplikację desktopową na Linuksa zawierającą ChatGPT, ChatGPT Work i Codex, ale natywne sterowanie komputerem nie jest dostępne w momencie premiery.

Lokalna inferencja i sprzęt

Cena RTX PRO 6000 podwojona. Firma Nvidia niemal podwoiła sugerowaną cenę detaliczną (MSRP) karty RTX PRO 6000 Blackwell z 96 GB do 16 000 dolarów, podczas gdy w zeszłym roku ceny przedsprzedażowe wynosiły poniżej 8 000 dolarów.

Strumieniowanie DSpark na jednym GPU. Pojedyncza karta RTX PRO 6000 96GB może uruchomić DeepSeek V4 Flash 284B z prędkością około 31 tokenów na sekundę z drafterem DSpark w pamięci RAM systemowej, co jest około 15–17% szybsze niż w przypadku bazowego rozwiązania bez draftera przy takim samym użyciu VRAM.

Muse Glimmer na Macu. Muse Glimmer 30B od Meta działa teraz nawet około 3,3 razy szybciej na układach Apple Silicon dzięki mlx-dspark, oferując jakość 8-bitową przy prędkościach zbliżonych do 4-bitowych na Macu z 48 GB pamięci.

Gemma 4: kwantyzacja KV cache. Trenowanie uwzględniające kwantyzację pomaga modelowi Gemma 4 31B zachować jakość przy agresywnej kwantyzacji pamięci podręcznej KV, co czyni wnioskowanie z dużym kontekstem bardziej praktycznym.

Przemysł i biznes

Cognition zbiera fundusze przy wycenie 40 mld $. Producent agentów do kodowania AI, firma Cognition, podobno prowadzi rozmowy w sprawie pozyskania finansowania przy wycenie 40 miliardów dolarów po osiągnięciu rocznego tempa przychodów na poziomie 1 miliarda dolarów, w porównaniu z 492 milionami dolarów trzy miesiące temu.

Lovable osiąga 13,3 mld $. Startup Vibe-coding Lovable pozyskał 400 milionów dolarów przy wycenie 13,3 miliarda dolarów po przekroczeniu 500 milionów dolarów rocznych przychodów, z 60 milionami hostowanych projektów.

Thrive Holdings: AI dla przedsiębiorstw. Thrive Holdings, wspierany przez OpenAI, pozyskał 2 miliardy dolarów przy wycenie 12 miliardów dolarów na przejmowanie tradycyjnych firm i wdrażanie AI, rozszerzając działalność poza księgowość i IT.

Spadek udziału Gemini. Dane rynkowe z Pangram, OpenRouter i Similarweb pokazują spadek użycia Gemini, a Pangram odnotowuje spadek do 1,9% w pisaniu AI, podczas gdy OpenAI utrzymuje ponad 50%.

Claude dla sektora prawnego. Firma Anthropic zatrudniła założyciela legal AI, Roberta Mahariego, jako pierwszego szefa Claude for Legal, opierając się na wcześniejszych wtyczkach prawnych i partnerstwach.

Polityka, bezpieczeństwo i społeczeństwo

Wyciek w łańcuchu dostaw LiteLLM. Atak na łańcuch dostaw LiteLLM ujawnił terabajty poświadczeń z ponad 2500 organizacji, w tym Microsoft, Amazon i Samsung, za pośrednictwem złośliwych pakietów PyPI.

Znaki wodne w wynikach Claude. Firma Anthropic znakuje obecnie wyniki Claude znakami wodnymi, aby spełnić wymogi unijnego aktu o sztucznej inteligencji, co niepokoi użytkowników, którzy obawiają się, że ujawni to użycie AI w pracy lub szkole.

Twitch: domyślne trenowanie. Platforma Twitch będzie domyślnie trenować modele AI Amazon na treściach streamerów, a teraz dostępny jest przełącznik rezygnacji; polityka ta wywołała falę krytyki.

ShieldFont zastępuje tekst. Projektanci wydali ShieldFont, czcionkę, która wyświetla użytkownikom normalny tekst, ale w podstawowym kodzie HTML podmienia słowa, aby zatruwać skanery.

Hinton, Li, Ng o otwartej AI. Podczas konferencji Ai4 Geoffrey Hinton, Fei-Fei Li i Andrew Ng argumentowali za utrzymaniem otwartości AI, aby uniknąć sytuacji, w której kilka firm kontroluje dostęp, mimo obaw o bezpieczeństwo związanych z otwartymi wagami.

Niszczenie rzadkich książek. Księgarze obawiają się, że firmy AI kupują rzadkie książki i niszczą je na potrzeby trenowania, mimo że istnieją nieinwazyjne alternatywy skanowania.

Badania i benchmarki

MindTopo: rozumowanie topologiczne. Benchmark MindTopo od Microsoft Research pokazuje, że modele multimodalne dobrze radzą sobie ze statycznym rozpoznawaniem topologicznym, ale mają trudności z interaktywnym planowaniem, które wymaga utrzymywania relacji w czasie.

Prompty zrekonstruowane z wyników. Naukowcy z IIT Bombay i Adobe Research opracowali metodę Previous-Token Prediction, która pozwala odtworzyć prompty LLM z tekstu wyjściowego z niemal idealną dokładnością bez dostępu do wag modelu.

To wszystko na dziś - około 5 minut czytania.

Czytaj go każdego ranka, prosto w przeglądarce

Rozszerzenie otwiera to podsumowanie w panelu bocznym Chrome — jeden klik, bez konta.

Dodaj do Chrome — za darmo