Agentic AI News Dzisiaj

Wiadomości o agentach AI dnia w jednym 5-minutowym czytaniu: premiery, narzędzia, badania, finansowanie i ruchy korporacyjne.

Aktualizowane codziennie wybrane z 30 źródeł Tydzień kończący się Lipiec 12, 2026

Modele i konkurencja

Claude Fable 5 na czele benchmarków. Claude Fable 5 firmy Anthropic zdobył pierwsze miejsca w benchmarkach Artificial Analysis, ale jego wysoki koszt skłonił firmę do zalecania używania go jako planisty delegującego zadania tańszym modelom, co obniża wydatki o ~40% przy zachowaniu większości możliwości.

Inżynieria agentów i infrastruktura

Bun przepisany przez 64 agentów. Claude Fable 5 zorkiestrował 64 równoległe instancje, aby przepisać Buna z Ziga na Rusta w 11 dni, tworząc ponad milion linii kodu i naprawiając 128 błędów kosztem 165 000 USD.

Audyt SWE‑Bench Pro wypada słabo. OpenAI odkryło, że około 30% zadań SWE‑Bench Pro jest uszkodzonych i wycofało swoje poparcie, powtarzając wcześniejsze obawy Artificial Analysis i podważając ocenę kodowania agentowego.

Modal pozyskuje 355 mln USD. Modal zabezpieczył 355 milionów dolarów na budowę infrastruktury chmurowej zaprojektowanej specjalnie dla agentów AI, koncentrując się na izolowanych środowiskach umożliwiających szybkie iteracje dla autonomicznego oprogramowania.

Tymczasowe konta Cloudflare dla agentów. Cloudflare wprowadził tymczasowe konta, które pozwalają agentom AI wdrażać Workers bez stałych poświadczeń, z wygaśnięciem, jeśli nie zostaną odebrane, co usprawnia przepływy pracy sterowane przez agentów.

Agenci trafiają na lokalne GPU. Nowe techniki kwantyzacji i opłacalne zestawy GPU umożliwiają uruchamianie modeli MoE na sprzęcie konsumenckim, ale benchmarki pokazują, że kwantyzacja niższej bitowości może poważnie pogorszyć zadania agentowe, co nakazuje ostrożny wybór kwantyzacji.

Bezpieczeństwo, prawo i interpretowalność

Jacobian Lens mapuje umysł modelu. Jacobian Lens firmy Anthropic ujawnia mały zestaw werbalizowalnych reprezentacji, które oddają kluczowe rozumowanie modelu, umożliwiając wykrywanie halucynacji, sterowanie wyjściem, a jak pokazują demonstracje społeczności, natychmiastowe tworzenie szkodliwych wariantów.

Ransomware sterowany przez agenta. Sysdig udokumentowało agenta AI, który zajął się technicznym wykonaniem ataku ransomware, choć człowiek przygotował operację, co podkreśla obecne możliwości i ograniczenia złośliwego oprogramowania agentowego.

Kryzysy nadużyć AI. Pozew sądowy zarzuca, że Grok od xAI generował obrazy CSAM, podczas gdy Boko Haram używa chatbotów do planowania ataków; incydenty podkreślają pilną potrzebę zabezpieczeń w miarę skalowania możliwości agentów.

Apple pozywa OpenAI. Apple złożyło federalny pozew sądowy, oskarżając OpenAI o kłusownictwo ponad 400 pracowników w celu kradzieży tajemnic handlowych związanych ze sprzętem, potencjalnie w celu zbudowania konkurencyjnego smartfona AI, co zaostrza walki prawne w branży AI.

To tyle na ten tydzień - do zobaczenia w przyszłą niedzielę.

Czytaj go każdego ranka, prosto w przeglądarce

Rozszerzenie otwiera to podsumowanie w panelu bocznym Chrome — jeden klik, bez konta.

Dodaj do Chrome — za darmo