Agentic AI News Bugün

Günün AI ajanları haberleri, 5 dakikalık bir okumada: sürümler, araçlar, araştırmalar, fonlamalar ve kurumsal hamleler.

Günlük güncellenir 30 kaynaktan derlenmiştir Cumartesi, Ağustos 15, 2026

Model Sürümleri

Qwen 3.8 27B. Alibaba'nın Qwen ekibi, Qwen3.8-27B ve daha büyük Qwen3.8-2.4T-A95B'yi Apache 2.0 lisansı altında yayınladı. 27B yoğun model, Qwen3.6-27B ile aynı mimariyi paylaşıyor ancak eğitim değişiklikleriyle kodlama, ofis görevleri ve ajan planlama yeteneklerini iyileştiriyor. 262 bin doğal bağlamı destekliyor, 1M tokena kadar genişletilebilir.

Zhipu'dan GLM-5.3. Zhipu AI, GLM-5.2 ile aynı temel modeli kullanan ancak eğitim sonrası genişletilmiş GLM-5.3'ü yayınladı. Şirket, bunun en güçlü açık ağırlıklı kodlama modeli olduğunu ve ajan kodlaması ile siber güvenlik açığı keşfinde önemli kazanımlar sağladığını iddia ediyor. Ağırlıkların iki hafta içinde Hugging Face'te yayınlanması bekleniyor.

Meta'nın Muse Glimmer'ı. Meta, tüketici GPU'larında yerel iş akışlarına yönelik Apache 2.0 lisanslı 30B ajan modeli Muse Glimmer'ı açık kaynak olarak yayınladı. Daha büyük Muse Spark'tan akıl yürütme ve araç çağırma becerilerini damıtır ve bir süreliğine 30B sınıfının sınırında kaldı.

Çin açık model dalgası. Bir aydan az bir sürede Çin laboratuvarları Kimi K3, Qwen3.8, DeepSeek-V4-Pro-0813 ve GLM-5.3'ü piyasaya sürerek açık ağırlıklardaki hızlı ilerlemeyi gözler önüne serdi.

Yerel Dağıtım ve Topluluk

Apple Silicon hız artışı. Yeni bir mlx-dspark sürümü, Apple Silicon üzerinde Qwen3.8-27B'ye spekülatif kod çözme getiriyor ve M4 Pro'da aynı çıktı tokenlarını üretirken yaklaşık 3 kat daha hızlı üretim sağlıyor.

Nicemleme ve ağırlıklar. Unsloth, Qwen3.8-27B nicelenmiş ağırlıklarını yayınladı ve Tim Dettmers, GLM-5.3'ü tek bir DGX Spark'ta 7 token/sn hızında çalıştırabilecek yeni bir nicemleme yönteminin ipuçlarını verdi.

Erken Qwen 3.8 testleri. Topluluk testleri, Qwen3.8-27B'de güçlü tek atışlık kodlama demoları ve ajan davranışı gösteriyor, ancak bazı kullanıcılar yüksek akıl yürütme çabasında genel bilginin belirgin şekilde budandığını ve çok uzun düşünme izleri olduğunu bildiriyor. Önerilen örnekleme parametreleri model kartında mevcuttur.

Sansürsüz yerel varyant. Qwen3.8-27B'nin topluluk 'heretic' sürümü, reddetmeleri ve güvenlik önlemlerini kaldırarak Opus 4.6 gibi bir sınır modeli seviyesinde yerel sansürsüz bir alternatif sunmayı amaçlıyor.

Yapay Zeka Şeffaflığı ve Güvenliği

Anthropic filigran tespiti. Anthropic, üçüncü taraf geliştiricilerin Claude tarafından üretilmiş olabilecek metinleri tespit edebilmesi için bir filigran tespit API'si sunacak. Yöntem SynthID Text kullanıyor ve kısa, gerçek odaklı veya yoğun şekilde yeniden yazılmış metinlerde daha az güvenilir.

Google filigranı isteğe bağlı hale getiriyor. Google, kullanıcıların Nano Banana, Omni ve Lyria'dan yapay zeka ile üretilen görsellerde, videolarda ve müziklerde görünür filigranları kapatmasına izin veriyor. Görünmez SynthID ve C2PA meta verileri doğrulama için hâlâ gömülü olacak.

Mahkemede prompt enjeksiyonu. Connecticut'taki bir yargıç, davayı inceleyen yapay zeka sistemlerini manipüle etmeyi amaçlayan gizli metin içeren ilk ABD mahkeme başvurusu gibi görünen durumu belgeledi. Gizli talimatların hiçbir etkisi olmadı, ancak yargıç bu taktiği tehlikeli olarak nitelendirdi.

Üretimde Ajanlar

Claude Code bakım görevi. Anthropic, Claude Code'un kendi uygulamalarında günlük bakım yaptığını, insan incelemesinin ardından yüzde 46 birleştirme oranıyla 388 çekme isteği oluşturduğunu söylüyor. Rutinler arasında çökme testi, tekrarlanan soyutlama temizliği ve bağımlılık kontrolleri yer alıyor.

OpenAI Computer History. OpenAI'nin Computer History özelliği, Chronicle ekran görüntüsü prototipinin yerini alarak macOS'ta tıklamaları, tuş vuruşlarını ve uygulama geçişlerini kaydedip aranabilir bir zaman çizelgesi oluşturuyor. Tekrarlayan iş akışlarını tespit edebilir ve ChatGPT ile Codex için yeniden kullanılabilir beceriler önerebilir.

Endüstri ve İş Dünyası

ABD-Çin fiyat savaşı. Çin'in açık modelleri güç kazanırken OpenAI ve Anthropic fiyatları düşürüyor; Google'ın Gemini 3.7 Flash'ı, kodlama ve ajanlara yönelik yüzde 50 tanıtım indirimiyle piyasaya çıkıyor. Önde gelen ABD laboratuvarlarının token fiyatları Temmuz ortasından bu yana neredeyse dörtte bir oranında düştü.

GPT-5.6 Sol Ultrafast. OpenAI, Cerebras destekli GPT-5.6 Sol için saniyede 750 çıktı tokenına kadar hız sağlayan Ultrafast modunun bir önizlemesini yayınladı. API hizmeti başlangıçta seçili müşterilerle sınırlı ve olaylar veya piyasa olayları sırasında gerçek zamanlı analiz amaçlı.

Meta'nın herkes için yapay zekası. Meta, Glimmer sürümünü, yapay zekanın herkese açık olması gerektiğini savunan uzun bir Zuckerberg mektubuyla birleştirdi, ancak podcast kapsamı şirketin en güçlü Muse Spark'ını API'lerin arkasında tuttuğuna dikkat çekiyor. Aynı tartışmalar, 250 milyon dolarlık bir satın almanın ters gittiğini de işaret ediyor.

Apple-Alibaba Çin modeli. Apple'ın, Apple Intelligence'ı Çin cihazlarına getirmeden önce Alibaba'nın yardımıyla Çin pazarı için özel bir yapay zeka modeli eğittiği bildiriliyor. Bu ortaklık, nadir bir ABD-Çin yapay zeka iş birliği.

Kog çıkarım hamlesi. Fransız girişimi Kog, AMD MI300X ve Nvidia H200 gibi geleneksel GPU'lardan daha fazla hız elde etmek için yazılım optimizasyonu kullanıyor ve yazılım mühendisliği iş yükleri için daha hızlı tek istek kod çözmeyi hedefliyor.

Doğal gaz fiyat riski. Yeni bir Noreva tahmini, Amazon, Google, Meta ve Microsoft gibi hiper ölçekleyicilerin yapay zeka veri merkezleri için gaz enerjisini bağlamasıyla ABD'nin bazı bölgelerinde doğal gaz fiyatlarının üç katına çıkabileceği konusunda uyarıyor.

Araştırma Öne Çıkanlar

150M ARC modeli. 150M parametreli yinelenen gizli akıl yürütme modeli, ARC-AGI-1'de görev başına 0,0007 ABD doları maliyetle %29,5 puan alıyor ve yayınlanan maliyet-doğruluk sınırının dışında kalıyor. Minimal donanımda çalışıyor; ancak milyarlarca parametreye ölçeklendirme hâlâ gerekli.

Otonom araştırma şüpheleri. Princeton ve İngiltere AISI tarafından yayınlanmamış NeurIPS makaleleri kullanılarak yapılan bir çalışma, mevcut sınır modellerinin araştırma mühendisliğini yürüttüğünü ancak araştırmanın önemli kısımlarında başarısız olduğunu ortaya koydu; bu da laboratuvarların otonom yapay zeka araştırması iddialarıyla çelişiyor.

DarwinX harness evrimi. DarwinX, model ağırlıklarını sabit tutarak promptlar, araçlar, beceriler ve kontrol akışı üzerinde doğal seçilim yoluyla ajan harness'lerini evrimleştirir. Dört kıyaslamada ortalama yaklaşık 17 puan ekler ve değişmeden SWE-bench Verified'a aktarılır.

PlayWorld kıyaslaması. PlayWorld, 171 uzun vadeli hedefi takip eden çok modlu ajan oyuncularını kullanarak video dünya modellerini kıyaslar; geometri tutarlılığı, etkileşim doğruluğu, görünmeyen evrim ve içgörü evrimini ölçer.

Bugünlük bu kadar - yaklaşık 5 dakikalık okuma.

Her sabah doğrudan tarayıcınızda okuyun

Eklenti bu özeti Chrome'un yan panelinde açar — tek tıkla, hesap gerekmez.

Chrome'a Ekle — Ücretsiz