Agentic AI News Bugün

Günün AI ajanları haberleri, 5 dakikalık bir okumada: sürümler, araçlar, araştırmalar, fonlamalar ve kurumsal hamleler.

Günlük güncellenir 30 kaynaktan derlenmiştir Pazartesi, Ağustos 24, 2026

Ajan ve Model Çıkışları

Gizemli Ox Alpha. OpenRouter'da Ox Alpha adlı yeni ve ücretsiz bir model ortaya çıktı: kodlama ve uzun süreli ajan işleri için bir muhakeme modeli, ancak geliştiricisi anonim. Stripe CEO'su Patrick Collison onu “çok etkileyici” olarak nitelendirdi; spekülasyonlar GLM'den Microsoft'un MAI'sine kadar uzanıyor.

Araçlar ve Framework'ler

Cloudflare OS açık kaynak. Cloudflare OS açık kaynak yapıldı. Bu kurumsal AI platformunda her belge veya uygulama izole bir sanal alanda (‘Gadget’) çalışıyor; böylece teknik olmayan kullanıcılar güvenle vibe code yapabiliyor. Platform, bağlayıcılara sahip sohbet robotları, iş akışı otomasyonu ve yetki tabanlı bir modelle politika uygulaması içeriyor.

DeepSeek Harness beğenildi. Bir kullanıcı, DeepSeek Harness'ın ajan iş akışları için mükemmel olduğunu bildiriyor: kademeli kurulum ve doğal dil istekleri, bir PR beklemeden SimpleX ile entegrasyona olanak sağladı. Araç, istenen ajan davranışına göre şekillendirilebilecek kadar esnek.

Yerel ve Açık Modeller

Qwen 3.8'in yerel etkisi. Topluluk raporları, Qwen 3.8 27B'yi yerel kodlama ve OCR için çığır açan bir model olarak nitelendiriyor; OCR kalitesi Gemini 3.5 Flash Lite'dan daha iyi, performansı ise bir yıl önceki frontier modellerle karşılaştırılabilir. Quant karşılaştırmaları (Atomic Dynamic GGUF), Q4-Q6 arası farkların büyük olmadığını gösteriyor; Q3 XXS gibi düşük quantlar ise 24 GB Mac mini'de saatlerce otonom çalışabiliyor. Ancak 39 bin satırlık C-to-HTML portunun tek seferde yapılması, Opus 5'ten yalnızca vasat bir sonuç verdi; bu da yerel modellerin büyük ölçüde harness ve prompt'a bağlı olduğunu gösteriyor.

60 MB uzun bağlam LLM. Bir geliştirici, 250M parametreli bir modeli 30B token üzerinde eğitti ve 2 bitin altına quantize ederek CPU'da 80 MB RAM ile 400 tok/s hızında çalıştırdı. Model, eski bağlamı 320 bayt/token ile diske sıkıştırarak 1 milyon tokena kadar geçmişi saklayabiliyor; ancak bu geçmiş üzerinde muhakeme yürütecek şekilde eğitilmemiş.

Dreamer 4 150 doların altında. 1,57B parametreli Dreamer 4 dünya modeli, bilinen aksiyonlar içeren Procgen tarafından üretilen kareler kullanılarak sıfırdan 150 doların altında bir maliyetle eğitildi. Tokenizer PSNR değeri 40,41'e ulaştı; bu da frontier ölçeğinde dünya modellerinin gerekli olmadığını gösteriyor.

Yerel optimizasyon özeti. Raporlar arasında Windows'ta llama.cpp'den Linux'ta vLLM'ye geçişte %30-50 hız artışı, llama.cpp'de yüksek bellekli makineler için GLM-4.5-Air MTP desteği, Q8 kalitesine yakın performansı Q6 boyutunda sunan ConvRot quant ve 100k+ bağlamla EPYC+5090 üzerinde 24 tok/s hızında çalışan deepseek-v4-flash Q8 yer alıyor.

Araştırma Öne Çıkanları

Bellek kaynaklı bilişsel tuzaklar. MemTrapBench, LLM'lerde bellek kaynaklı bilişsel tuzakları (muhakeme sabitlenmesi, inanç çarpıtması) değerlendiriyor; test edilen tüm bellek stratejileri, belleksiz taban çizgisinin %10'dan fazla altında kalıyor. AdaptiveMem ise performansı korurken tuzakları azaltıyor.

SkillEvo evrim gradyanları. SkillEvo, ajan becerileri için güvenilir evrim gradyanları üretmek amacıyla çok turlu etkileşim geri bildirimini kullanıyor. Bu yöntem, tek turlu soru-cevap tabanlı geri bildirimin bozulmasını ele alıyor ve beceri hatalarının yapısal olarak onarılmasını sağlıyor.

Ekran görüntülerinden VLM. 450M'lik bir VLM'yi 50K tarayıcı ekran görüntüsü üzerinde ince ayar yapmak, görev performansını 1/100'den 44/100'e yükseltti; bu da küçük modellerin ajan görevleri için UI anlayışını öğrenebileceğini gösteriyor.

AI bilim insanı paradoksu. Teorik bir ekonomi makalesi, yapay zekânın sağladığı zaman tasarrufunun araştırmacıları her birine daha az çaba harcayarak daha fazla proje yapmaya itebileceğini ve dil modelleri kusursuz çalışsa bile araştırma kalitesini düşürebileceğini öne sürüyor.

Sektör ve İş Dünyası

Anthropic'in ucuz rakipleri. Anthropic'in yıllıklandırılmış geliri 65 milyar dolara ulaştı; ancak en iyi modeli Fable 5, Opus 4.8'e (%28) kıyasla çok az benimseniyor (Ramp harcamalarının %8'i) ve daha ucuz araçlar öne çıkıyor. OpenAI'ın geliri GPT-5.6 lansmanından sonra %35 arttı.

Stripe OpenRouter'ı satın aldı. Stripe'ın OpenRouter'ı satın alması, tokenların ekonomik bir kaynak haline geldiğine işaret ediyor. OpenRouter'da ajan token kullanımı Şubat'tan bu yana 14 kat artarken insan kullanımı yalnızca 2,8 kat arttı; ajan tokenlarının %70'i önbelleğe alınmış promptlardan geliyor. Ajanlar giderek maliyet, gecikme ve güvenilirliğe göre model seçiyor.

Nvidia sunucu fiyatlarında %15 artış. Bellek kıtlığı, Samsung, SK Hynix ve Micron'daki DRAM maliyet artışları nedeniyle Vera Rubin ve Grace Blackwell sistemlerinde Nvidia AI sunucu fiyatlarını %15'ten fazla yükseltiyor; bu da bulut devlerini ve AI laboratuvarlarını etkiliyor.

Nvidia Poolside'ı lisanslıyor. Nvidia, Poolside'a 1 milyar dolar yatırım yapıyor ve teknolojisini lisanslamak için 6 milyar dolar ödüyor; 100'den fazla mühendisini Nemotron'a kaydıran şirket, Çin'in açık ağırlıklarıyla rekabet etmeyi hedefliyor.

AI yönetici çalışanı kovdu. Nisan'dan bu yana bir San Francisco mağazasını yöneten AI ajan Luna, tekrarlanan gecikmeler nedeniyle bir insan çalışanı işten çıkardı; ancak bu, insanların ona kendi kurallarını hatırlatmasından sonra gerçekleşti. Yedi modelle yapılan tekrarlarda, daha yetenekli AI'ların işten çıkarmayı daha tutarlı şekilde önerdiği görüldü.

Claude token gri pazarı. Çinli geliştiriciler, Claude tokenlarını resmi fiyatın yaklaşık %10'una satan aktarma istasyonları üzerinden Anthropic kısıtlamalarını aşıyor; denizaşırı sunucular, ücretsiz krediler ve model değiştirme yöntemleri kullanarak coğrafi engelleme ve güvenlik izlemesini zayıflatıyorlar.

Bugünlük bu kadar - yaklaşık 5 dakikalık okuma.

Her sabah doğrudan tarayıcınızda okuyun

Eklenti bu özeti Chrome'un yan panelinde açar — tek tıkla, hesap gerekmez.

Chrome'a Ekle — Ücretsiz