Agentic AI News Bugün

Günün AI ajanları haberleri, 5 dakikalık bir okumada: sürümler, araçlar, araştırmalar, fonlamalar ve kurumsal hamleler.

Günlük güncellenir 30 kaynaktan derlenmiştir Pazar, Ağustos 30, 2026

Ajan ve Model Sürümleri

Tencent Hy4 önizlemesi. Tencent, Hy3'e kıyasla önemli bir boyut artışı olan, varsayılan olarak yüksek muhakeme ve no_think modu sunan Hy4 önizlemesini yayınladı. Toplulukta halihazırda ~2,38-bitlik kuantize resmi bir sürüm ve BF16 performansının yaklaşık %98'ini koruduğu belirtilen ~200GB'lık bir GGUF bulunuyor.

Yerel Çıkarım ve Donanım

FlashMLA sm_120 portu. Topluluk derlemesi FlashMLA'yı tüketici sınıfı Blackwell sm_120 GPU'larına taşıyor; çeşitli seyrek MLA iş yüklerinde PyTorch SDPA'ya göre 2–3 kat hız artışı ve FP8 KV önbelleğiyle decode'da %8 daha düşük gecikme sağlıyor.

Nemotron 16GB düzeltmesi. Nemotron-3.5-Lightning'in düşük bitli GGUF'ları, satır genişliği kuantizasyonu nedeniyle sessizce ~4,70 bpw'ydi; yamalı llama.cpp derlemesi, 16GB bellekte 262K bağlam çalıştırabilen gerçek 3,07 bpw / 11,77 GiB dosyası üretiyor.

Mac'te Qwen3.8-Flash-Next. 79GB'lık 2-bit Qwen3.8-Flash-Next, llama.cpp kullanılarak 128GB'lık M5 Max üzerinde 350K bağlam alanıyla çalıştırıldı; buna 105K prompt için 333 saniyelik soğuk prefill ve ngram-mod spekülatif decode da dahil.

DeepSeek V4 Flash çift GPU. 2x DGX Spark/GX10 kurulumlarında DeepSeek V4 Flash 0731, sürekli 67–84 token/sn hıza ulaşıyor; yerel HumanEval Pass@1 skoru %94,5, GLM-5.3-Flash NVFP4 için ise %97,0. GLM, benchmark'ı yaklaşık yarı sürede tamamladı.

Çift 5090'da 1M bağlam. Bir NInfer fork'u, iki 5090 üzerinde Qwen3.8-27B NVFP4'ü 1.048.576 token bağlamla çalıştırmak için tensör paralelliği ve YaRN ×4 ölçeklendirmesi ekliyor; 1M'de 48–100 token/sn decode hızı sağlıyor ve vLLM'nin sıfıra düştüğü durumlarda MTP kabulünü koruyor.

27B 16GB'da. Qwen3.8-27B, hibrit kuantizasyon ve kvarn önbellek ayarları ile 16GB RTX 4070 Ti SUPER üzerinde MTP spekülatif decode ve tail-precision KV önbelleği kullanarak 100K bağlamla 50 token/sn hızında çalışabiliyor.

FreeToken MoE motoru. UC Berkeley ve MIT araştırmacıları, MoE uzman aktarımlarını dinamik olarak birlikte zamanlayan açık kaynaklı bir motor olan FreeToken'ı tanıttı. Bu sayede öncü seyrek modeller, PCIe/RAM miss'lerinde takılmadan tüketici GPU'larında decode yapabiliyor.

Benchmark ve Değerlendirmeler

Terminal Bench 4.0. Terminal Bench 4.0, doygunlukla mücadele etmek için yenilenmiş lider tablosu ve hızlı iterasyon odağıyla yayınlandı; GLM-5.3, hata payı dahilinde Fable 5 seviyesinde skor alıyor.

Finans benchmark açıklaması. Ling-3.0-flash-Fin için yayınlanan benchmark kartı, ajan altyapısı, araçlar ve değerlendirme boru hatlarının bildirilen sonuçları ne kadar etkilediğini gösteriyor. Birçok çalıştırma, web araması ve Python içeren ReAct kullandı; bazı değerlendirme setleri ise kurum içi veya henüz yayınlanmış değil.

Araştırma ve Ajan Altyapısı

Google WikiSkill belleği. Google Research'ın WikiSkill'i, ajanlara geçmiş başarısızlıkları ve başarıları içeren kalıcı, wiki benzeri bir bilgi tabanı sağlıyor; model ağırlıklarını değiştirmeden davranışı yönlendiren yeniden kullanılabilir Agent Skills'leri barındırıyor.

Anthropic Model Donanım Standardı. Anthropic, ajanların mikroskop ve robotik kol gibi fiziksel cihazları kontrol etmesini sağlayan birleşik bir arayüz olan MHS'yi geliştiriyor; ilk testler çok makineli entegrasyonu haftalardan saatlere indirdi, ancak insan denetimi hâlâ gerekli.

Ajanlar için veri katmanı. TOTVS sunumu, işlemsel sistemlerin ve veri göllerinin çok token tüketen, gecikmeye duyarlı ajan muhakemesi için optimize edilmediğini savunuyor. Sunum ayrıca veri erişiminin MCP ve anlamsal modellere doğru evrildiğini anlatıyor.

LAION BVD. LAION, araştırma amaçlı BVD'yi yayınladı. 10 milyon saat video, 55 milyon klip ve 300 milyon durağan görüntü içeren veri seti, video, ses ve metni ilişkilendiriyor. Bu veriyle eğitilen modeller, bazı benchmark'larda InternVid taban çizgilerini 2,1 puana kadar geride bıraktı.

Sektör ve İş Dünyası

Sony ve Warner'dan Anthropic'e dava. Sony Music Publishing, Warner Chappell ve diğer yayıncılar Anthropic'e dava açtı. Şirketler, Claude'u eğitmek için telif hakkıyla korunan eserleri torrent yoluyla indirip kazıdığını iddia ederek eser başına 150.000 dolara kadar tazminat talep ediyor. Anthropic kendini savunacağını söylüyor.

OpenAI'nin Cursor kesintisi. OpenAI, Cursor'ın SpaceX tarafından satın alınmasının ardından sözleşmesini sonlandırıyor; gerekçe olarak Elon Musk'ın şirketlerinin sözleşmeleri ihlal etme geçmişini gösteriyor. Anthropic ise kendini daha güvenilir ortak olarak konumlandırdı ve Cursor'ın Claude kullanımı için işlem gücü sağlamaya devam edeceğini taahhüt etti.

Nvidia, GPU'ların ötesinde. Nvidia'nın kazanç anlatısı, GPU payından veri merkezi orkestrasyonuna ve GPU çevresindeki sistemlere doğru kayıyor; yapay zeka işlem gücü gigawatt seviyelerine ölçeklenirken şirket bu alanda son teknoloji ağ ve orkestrasyon donanımı inşa etti.

Bugünlük bu kadar - yaklaşık 5 dakikalık okuma.

Her sabah doğrudan tarayıcınızda okuyun

Eklenti bu özeti Chrome'un yan panelinde açar — tek tıkla, hesap gerekmez.

Chrome'a Ekle — Ücretsiz