Agentic AI News Dzisiaj

Wiadomości o agentach AI dnia w jednym 5-minutowym czytaniu: premiery, narzędzia, badania, finansowanie i ruchy korporacyjne.

Aktualizowane codziennie wybrane z 30 źródeł Czwartek, Sierpień 20, 2026

Otwarte i lokalne wydania modeli

Otwarta rodzina Ornith-1.5. Ornith-1.5 wydano w wersjach 9B gęstej, 35B MoE i 397B MoE na licencji MIT, z mocnymi benchmarkami agentowymi i kodowania; społecznościowe kwantyzacje pokazują, że 35B działa z prędkością 60 tk/s na 12GB 4070 Ti, a 9B przewyższa wcześniejsze małe modele.

Raporty z użytkowania Qwen3.8-27B. Lokalni użytkownicy raportują, że Qwen3.8-27B może autonomicznie wykonywać ponad 80 wywołań narzędzi i obsługiwać długie łańcuchy agentowe, ale jego wiedza offline i ścisłe oceny kodowania są słabsze niż u poprzedników, więc najlepiej działa z jasnym kierunkiem lub jako copilot.

Przyspieszenia i kwantyzacje Qwen3.8. Wysiłki społeczności pchnęły Qwen3.8-27B do 138 tps na RTX 3090 z DFlash2, wydano kwantyzacje Dynamic V3 twierdząc o 10% wyższej dokładności, przycięte głęboko 22.7B Mini-Me oraz natywne FP4 na V100 z 2017 roku dorównujące 5090.

Checkpointy bazowe Ling. AntLing udostępnił jako open source bazowe i midtrain checkpointy dla Ling-3.0-tiny i flash bez post-treningu, a użytkownik łączy Ling tiny jako pomocniczy do kompresji kontekstu wraz z Qwen3.8.

Kwantyzacje LFM2.5 QAD. Liquid AI wydało checkpointy Q4_0 trenowane z destylacją uwzględniającą kwantyzację, odzyskując 97% dokładności BF16 przy tej samej prędkości i pamięci.

GLM-5.3 i wydania graniczne. GLM-5.3 dorównuje Kimi K3 na szczycie rankingów otwartych modeli, z dużymi zyskami agentowymi i niższym kosztem, choć otwarte wagi są opóźnione o dwa tygodnie; DeepSeek V4-Pro GA oraz NVIDIA Nemotron 3.5 Lightning/NeMo Switchyard również zostały wydane.

Narzędzia agentowe i aktualizacje produktów

Bezpieczne piaskownice. Simon Willison przetestował smolmachines/smolvm jako piaskownicę dla niezaufanego Pythona i JavaScript z limitami CPU/RAM i bez sieci; Jeremy Morrell argumentuje, że rozszerzenia tworzone przez LLM plus prymitywy piaskownicy umożliwiają bezpieczne rozszerzalne oprogramowanie.

Darmowy tryb Replit. Replit wprowadził darmowy tryb zasilany przez GPT-5.6 Luna, pozwalający każdemu tworzyć aplikacje i agentów bez ograniczeń kosztów tokenów.

Notatki AI w Calendly. Calendly wszedł w notowanie spotkań z podsumowaniami, elementami działań i nadchodzącym asystentem Callie, który wykorzystuje kontekst spotkania do planowania dalszych kroków.

Aplikacja Meta AI na Maca. Meta uruchomiła aplikację na Maca dla swojego czatbota AI z udostępnianiem ekranu, dyktowaniem i integracją z Google Workspace, aby konkurować z asystentami desktopowymi Gemini, ChatGPT i Claude.

Wykrywanie oszustw na urządzeniu w WhatsApp. WhatsApp testuje Scam Alert, opcjonalny model na urządzeniu, który klasyfikuje wiadomości od osób niebędących kontaktami, wykorzystując poufną analitykę federacyjną w celu zachowania prywatności.

Narzędzia do nauki Google. Google wdrożyło centrum studenckie Gemini, interaktywne wizualizacje i quizy generowane przez AI w wyszukiwarce oraz Deep Research w Gemini Live z okazji powrotu do szkoły.

Alexa+ za darmo na Fire TV. Amazon udostępnił Alexa+ za darmo na Fire TV bez Prime, wdrażając automatycznie wyszukiwanie konwersacyjne, sterowanie smart home i rekomendacje AI.

Przemysł i biznes

Stripe kupuje OpenRouter. Stripe potwierdził przejęcie OpenRouter za 7,5 miliarda dolarów, a założyciele wskazali 'osobliwość' jako powód, aby pozostać prywatnym i inwestować w infrastrukturę agentową.

Zaprzeczenie raportowi o SpaceX-Cognition. Bloomberg poinformował, że SpaceX próbowało przejąć Cognition, ale dyrektor generalny Scott Wu zaprzeczył tej historii, mówiąc, że Cognition nie jest na sprzedaż i nie odbyły się żadne rozmowy.

Prowadzenie Anthropic w przychodach. Anthropic po raz pierwszy wyprzedził OpenAI w kwartalnych przychodach, osiągając 11,6 mld dolarów z niewielkim zyskiem operacyjnym, podczas gdy przychody OpenAI w wysokości 6,7 mld dolarów wiązały się z głębszymi stratami.

Moc obliczeniowa jako klasa aktywów. Nvidia pracuje z Apollo, BlackRock i innymi nad finansowaniem o wartości 500 mld dolarów, aby traktować moc obliczeniową jako aktywa inwestycyjne; Silicon Data zebrało 30 mln dolarów na uruchomienie kontraktów terminowych CME GPU.

Pamięć i dostawy chipów. Ceny DRAM wzrosły o 500% w ciągu 12 miesięcy, a hiperskalerzy zablokowali dostawy na 2027 rok; Chiny pozwalają na małe partie H200 dla ByteDance i Tencent w celu złagodzenia ograniczeń mocy inferencyjnej.

Infrastruktura centrów danych. TerraPower planuje projekt centrum danych wykorzystujący magazynowanie energii reaktora Natrium, a Relativity Networks zebrało 22 mln dolarów na światłowód z rdzeniem powietrznym, który przesyła dane o 50% szybciej.

Pogarsza się reputacja AI. Pew stwierdziło, że 52% Amerykanów jest bardziej zaniepokojonych niż podekscytowanych AI, a lokalne umowy na centra danych spotykają się z oporem społecznym.

Bezpieczeństwo, prywatność i ochrona

Prywatne przetwarzanie bezpieczeństwa OpenAI. OpenAI zaprezentował Private Safety Processing dla klientów z zerowym przechowywaniem danych, umożliwiając wykrywanie nadużyć w interakcjach bez ujawniania treści personelowi; kontrastuje to z polityką 30-dniowego przechowywania Anthropic.

OpenAI naprawia Codex i TAC. OpenAI wdrożyło zabezpieczenia po tym, jak Codex usunął prawdziwe pliki użytkowników przez błędne polecenia czyszczenia, i potwierdziło, że osobny błąd tymczasowo cofnął dostęp do programu Trusted Access for Cyber.

Exploity ICS generowane przez AI. Agencje USA ostrzegły, że atakujący używają AI do tworzenia skryptów exploitów dla Siemens S7, zmniejszając umiejętności i czas potrzebne do atakowania systemów sterowania przemysłowego.

Kontrole wewnętrzne laboratoriów AI. Pierwsza ocena Guidelight wykazała, że żadna firma AI w pełni nie stosuje podstawowych kontroli wewnętrznych; Anthropic i OpenAI prowadzą z oceną C+, a xAI i Meta otrzymały D- i F.

Reklamy deepfake Meta. Meta wyświetlała reklamy aplikacji do rozbierania AI wymierzone w polityczki, mimo polityk zakazujących materiałów o charakterze seksualnym.

Sprzedaż danych pracowników Spirit. Google wygrał aukcję na dane dotyczące zatrudnienia Spirit Airlines; byli stewardzi sprzeciwiają się, że poufność pracowników może nie być chroniona przed ponowną identyfikacją.

OpenAI spowalnia rozwój. OpenAI wstrzymało część treningów RL i opóźniło graniczne uruchomienia, zaostrzając zabezpieczenia, testując, czy dobrowolne spowolnienie może zadziałać bez przyjęcia w całej branży.

Badania i analizy

Projektowanie białek Claude. Modele Claude firmy Anthropic zaprojektowały minibindery dla 15 celów ze skutecznością 26,8%, przewyższając typowe wczesne wyniki odkrywania leków, choć niezależna ocena jest w toku.

Dane tkankowe Vivodyne. Robotyczne laboratoria HIVE firmy Vivodyne hodują 20 typów tkanek ludzkich i generują przyczynowe dane biologiczne, aby rozwiązać to, co uważa za brakujący problem danych w odkrywaniu leków przez AI.

Mit tokenów rozumowania. Badania podważają pogląd, że pośrednie tokeny LLM są semantycznie znaczącym rozumowaniem; modele często generują nieprawidłowe ślady nawet przy poprawnych odpowiedziach, a trening na uszkodzonych śladach nadal może działać.

Metryka produktywności kodowania. Simon Willison argumentuje, że linie oddebugowanego kodu produkcyjnego pozostają znaczącą metryką produktywności przy agentach kodujących, ale osiągnięcie takiego wyniku nadal wymaga umiejętności seniora inżynierii.

To wszystko na dziś - około 5 minut czytania.

Czytaj go każdego ranka, prosto w przeglądarce

Rozszerzenie otwiera to podsumowanie w panelu bocznym Chrome — jeden klik, bez konta.

Dodaj do Chrome — za darmo