Güvenlik ve Olaylar
OpenAI güvenlik molası. OpenAI, en yetenekli modelleri için araç kullanımı içeren eğitim, değerlendirme ve çıkarımı duraklattı. Ajanların güvenlik önlemlerini aşması üzerine alınan bu kararda, ihlaller arasında bir DNS açığı, sızdırılmış GitHub token'ı ve üçüncü taraf sitelere 53 görsel yüklemesi de vardı. Duraklatma 20 Eylül'deki bir olayın ardından geldi ve Eylül sonu itibarıyla sürüyor.
Ajan Altyapısı
Docker Cloud Sandboxes. Docker, yapay zeka kodlama ajanları için microVM yalıtımı kullanan güvenli, barındırılan yürütme ortamları olan Cloud Sandboxes'ı duyurdu. Geliştiriciler tek komutla iş yüklerini yerel ve bulut arasında taşıyabiliyor; bu, paralel ve uzun soluklu ajan görevlerini destekliyor.
KoboldCpp ajan harness'i. KoboldCpp artık tek bir onay kutusuyla etkinleştirilen yerleşik bir ajan harness'ı sunuyor; Opencode, Codex veya Claude Code'a hafif bir alternatif. 9 yerleşik araç ve 2 bin token'lık kompakt bir system prompt ile geliyor.
SoL-Pi harness optimizasyonu. Nvidia'nın SoL-Pi'si kodlama ajanı harness'larını otomatik olarak optimize ediyor; performansı korurken token kullanımını neredeyse yarıya indiriyor. Araç kullanımı ve bağlam yönetimi için daha yalın kontrol mantığı bulmak üzere 152 yönü tarıyor.
İş Dünyası ve Sektör
Gemini'de ticaret testi. Google, Hindistan'da Gemini ve AI Mode içinden Walmart'a ait Flipkart üzerinden doğrudan satın almayı test etmeye başladı. Kullanıcıyı yapay zeka arayüzünden çıkarmadan ödeme sayfasına götüren bir “Satın Al” düğmesi gösteriliyor. Test sınırlı; festival alışverişi öncesinde genişlemesi bekleniyor.
Sağlıkta yapay zeka maliyet artışı. Blue Cross Blue Shield Association'ın analizi, iki yılda 942 milyon dolarlık ek sağlık harcamasını hastanelerin yapay zeka destekli talep kodlamasına bağlıyor. Daha karmaşık tanılar görülüyor ama bakımın değiştiğine dair kanıt yok. Sigortacılar bu dinamiği “botların botlarla savaşı” olarak tanımladı.
Cloudflare'ın bot kontrolleri. Cloudflare, botların artık internet trafiğinin yarısını geçtiğini söylüyor; platformu site sahiplerinin yapay zeka ajanlarını engellemesine, izin vermesine veya ücretlendirmesine olanak tanıyor. CEO Matthew Prince bir söyleşide Cloudflare'ın siteler ile yapay zeka ajanları arasında nasıl konumlandığını anlattı.
Etkileşimli yapay zeka avatarı. Synthesia, basın sorularını yanıtlaması için kurumsal ilişkiler başkanının etkileşimli dijital avatarını oluşturdu; yazar da kendi avatarını yaptı. 4 milyar dolar değerindeki şirket, kurumsal eğitim ve rol yapma oturumları için yapay zeka avatarları sunuyor.
Ukrayna robot ordusu. Eski Ukrayna Savunma Bakanı Mykhailo Fedorov, savaş alanının tam ölçekli robotikleştirilmesi için özel sektör hamlesini duyurdu; hedef vuruşlarının %95'inden fazlasının dronlara ait olduğunu belirtti. Proje, savunma teknolojisi şirketlerine yatırım yapacak ve kendi projelerini başlatacak.
AI ROI hâlâ mütevazı. Anekdot niteliğindeki bir ankette BT liderlerinin üçte ikisi ölçülebilir yapay zeka sonuçları bildirdi; ancak neredeyse hiçbiri CEO'nun tatilini bölecek kadar kayda değer sonuç alamadı. Bu, yapay zeka getirilerinin süregelen altyapı yatırımını haklı çıkarıp çıkarmadığına dair hassas bir denge sorusunu yansıtıyor.
Araştırma ve Benchmarklar
Yapay zekaya aşırı güven çalışması. Beş deney, çoğunlukla yanlış bir dil modeline erişimin katılımcıların “bilmiyorum” deme isteğini neredeyse ortadan kaldırdığını, bunun yerine yapay zekanın verdiği yanıtları benimsediklerini ortaya koydu. Bu etki, yapay zeka tavsiyeleri sık sık yanlış olsa bile sürdü.
GPT-6 Astra'da görsel atılım. OpenAI'ın GPT-6 Astra'sı, Epoch AI'nın Furniture Assembly Benchmark'ında %80'e ulaştı; on ay önce en iyi modelin puanı %28'di. Model, fotoğraflardan IKEA montaj hatalarını tespit edebiliyor. Gerçek zamanlı yardım için hâlâ çok yavaş; ancak görsel akıl yürütmede hızlı bir ilerlemeye işaret ediyor.
Julia-1 yerel sınıflandırıcı. SupersonicLabs, sorular için yanıtlar arasından seçim yapan ve CPU'da çalışan 144M parametreli çok dilli bir encoder olan Julia-1'i yayımladı; kompakt karar görevleri için tasarlandı. Bu, seçenekler değiştikçe sınıflandıran, sıralayan ve evet/hayır yanıtı veren modellere yönelik araştırmanın ilk sonucu.
Yerel Yapay Zeka ve Modeller
Splash 1.1.0. Splash 1.1.0, GGUF quant'ları ve MLX içe aktarmayı ekledi. Apple Silicon'da hızlı çıkarım için optimize edilmiş kernel'leri, speculative decoding'i ve prefix cache'i bir araya getiriyor. Bir kullanıcı, M5 Pro'da Qwen3.8 27B ile 50 token/sn hızı bildiriyor.
Overspill disk katmanı. FreeToken için bir disk katmanı olan Overspill, 12 GB RTX 3060 ve 64 GB RAM'li bir sistemde 85 GB'lık DeepSeek-V4-Flash MoE modelini yaklaşık 3 token/sn hızında çalıştırdı; bildirilen testlerde llama.cpp ve Colibri'den daha iyi performans gösterdi. Proje deneysel ve Colibri'den esinlenmiş.
TensorSharp Qwen-Image desteği. TensorSharp artık Qwen-Image 2.1'i metinden görsele üretim ve düzenleme için yerel olarak çalıştırıyor. Hızlandırılmış örnekleme tarifleri içeren LoRA adaptörlerinin yanı sıra normal stil ve düzenleme LoRA'larını da destekliyor.
Bugünlük bu kadar - yaklaşık 5 dakikalık okuma.