Agent ve model sürümleri
Meta'nın Muse agent'ı. Muse, her kullanıcıya agent'ın yazılım kurabildiği, kod çalıştırabildiği ve internette gezinebildiği kalıcı bir Ubuntu VM veriyor. Meta, yeni özellikler için erken erişimi açıyor ve 3,4 milyondan fazla indirmeyle Muse'u yoğun biçimde tanıtıyor. John Gruber gibi eleştirmenler, tüketicilerin agent'lı bir bulut bilgisayarın ne kadar güçlü ve tehlikeli olabileceğini fark etmeyebileceği uyarısında bulunuyor.
- → Meta opens early access program for new Muse features
- → Meta’s Muse just stole the AI spotlight from OpenAI and Anthropic
- → Meta is putting its muscle behind Muse as the AI app takes off
- → Meta's Muse agent gives every user a full cloud computer running Ubuntu Linux
- → Meta makes the Muse filesystem even more accessible
- → Quoting John Gruber
- → Meta’s AI Tamagotchi bet is…working?
Microsoft'tan Copilot Autopilot. Microsoft'un yenilenen Copilot uygulamasına, OpenClaw üzerine kurulu, kendi bulut bilgisayarını çalıştıran ve Teams, Outlook ya da belgelerden tetiklenebilen proaktif bir agent olan Autopilot eklendi. Yeni Code sekmesi de geliştirici olmayanların doğal dille uygulama yapmasını sağlıyor.
Gemini Call for Me. Google, Gemini aboneliği bulunan Pixel 11 kullanıcıları için Call for Me'yi test ediyor; agent işletmeleri arıyor, telefon menülerinde geziniyor, beklemede kalıyor ve canlı bir transkript paylaşarak kullanıcının görüşmeyi devralmasına olanak tanıyor.
Jev tarzı açık karar modelleri. Apache lisanslı Mica 4B, metin üretmeden seçenekleri puanlayan bir karar modeli; 8 GB'lık bir GPU'da çalışıyor ve 30 doların altında bir maliyetle eğitildi. Minecraft ve Tetris testlerinde Kev 4B'yi geride bırakıyor; karşılaştırmalar, karar görevlerinde Kev'in Jev'in doğruluğuna 2 puan yaklaştığını gösteriyor.
- → Mica v0.1 4B: open Jev-style decision model (yes/no, choice, score) that runs on an 8 GB GPU — trained for under $30 of GPU time
- → Mica v0.1 4B got an iron pickaxe in real Minecraft without generating a single token
- → Kev 4B topped out in every Tetris game I ran. Mica v0.1 4B cleared about 4x more lines and survived two of them to the end
- → Jev vs. Kev: open-source Jev alternative tested side by side
Ling Tiny 3.0. 1 milyar aktif parametreli 8B MoE modeli, 2017 model bir dizüstü CPU'sunda saniyede 10 token hızında çalışıyor; bu da eski donanımda yerel agent kodlama döngülerini mümkün kılıyor.
Araçlar ve framework'ler
DistribAI v2. DistribAI v2, tüketici cihazları arasında dağıtık eğitim için C++/LibTorch tabanlı bir platform; çökmeleri ve kötü niyetli aktörleri yönetiyor. Geliştiriciler, ücretsiz Colab/Kaggle GPU'ları ile yerel bir 4070 SUPER'i birleştirerek birden fazla 5090'ın sağladığı hesaplama gücünü yakaladıklarını aktarıyor.
Stateless MCP. Güncellenen MCP spesifikasyonu, protokol düzeyindeki oturumları ve Mcp-Session-Id başlığını kaldırıyor; istekler artık bir yük dengeleyicinin arkasındaki herhangi bir sunucu örneğine gidebiliyor ve AWS dağıtımları basitleşiyor.
Volta için 1Cat-vLLM. 1Cat-vLLM adlı vLLM fork'u, V100 kartlarda optimize edilmiş serving desteği sunuyor; Qwen3.6-35B rakamları bir Strix Halo ile karşılaştırılmış.
LangGraph + Jev. LangChain'in blog yazısı, Jev ve LangGraph ile üretim ortamına yönelik agent'ların nasıl kurulacağını anlatıyor; yönlendirme ve sınıflandırmada yapılandırılmış karar modelleri kullanılarak maliyet ve gecikme düşürülüyor.
Perplexity'de CobbleDB. Perplexity, arama serving'i için DynamoDB'yi dahili bir Rust key-value deposuyla değiştirdi; saniyede 200 binden fazla istekte toplu okuma gecikmesini 5 kat, depolama maliyetlerini de en az %20 düşürdü.
Araştırmadan öne çıkanlar
LLM'ler Enigma'yı çözdü. Astra ve Opus, arşiv araştırması yapıp simülatörler kurarak ve açık metni ortaya çıkararak uzun süredir çözülemeyen iki Enigma mesajını deşifre etti. Bu, otonom tarih araştırmasının alışılmadık bir örneği.
KV cache nakli. Cache-to-Cache'den esinlenen bir Reddit kullanıcısı, Qwen3.8-27B'nin farklı kuantizasyonları arasında KV cache'lerini yeniden kullanarak, yeniden eğitim olmadan çıktı kalitesini artırmayı araştırıyor.
Qwengram n-gram transferi. Qwengram-0.8B, Qwen3.8 Flash-Next'in önceden eğitilmiş n-gram belleğini daha küçük bir Qwen3.5-0.8B omurgasına aktarıyor; omurgada fine-tuning yapmadan, küçük bir reader ile doğrulama perplexity'sini %5,05 düşürüyor.
Sektör ve iş dünyası
OpenRouter'ın çok modelli bahsi. OpenRouter, tarafsız bir yönlendirme katmanı olarak 10 milyondan fazla geliştiriciye ve günde 10 trilyon token'a hizmet verecek noktaya geldi; Alex Atallah, model çeşitliliğinin ve inference pazar yerlerinin nasıl ortak görüş haline geldiğini anlatıyor.
Yapay zeka bulut anlaşmaları. Crusoe, yapay zeka veri merkezlerinde Boom türbinlerini kullanmaya yönelik 1,25 milyar dolarlık planından vazgeçti. Nscale, halka arz öncesinde 3,36 milyar dolarlık konvertibl finansman topladı; Anthropic ise Akamai'nin bulutuna yedi yıl boyunca 11,6 milyar dolar taahhüt etti.
Anthropic kurucularının oy gücü. Anthropic'in kurucu ortakları, halka arz sonrasında kendilerine birlikte %50,1 oy gücü veren özel hisseler talep ediyor; yönetim kurulu koltuklarının çoğunu ise hâlâ Long-Term Benefit Trust seçiyor.
Tesla işçilerinden Optimus'a itiraz. Tesla çalışanları, kendi yerlerine geçecek Optimus insansı robotlarını eğitmeye yanaşmıyor; karmaşık eller ve ölçekleme sorunları V3 robotunun üretimini yavaşlatıyor.
Yapay zeka maliyet baskısı. NSA, yapay zeka modellerini test etmek için milyarlarca dolar harcamayı bekliyor. Hastanelerle sigorta şirketleri faturalar üzerinde yapay zekayla çekişirken sağlık maliyetleri yükseliyor; bu da token bazlı fiyatlandırmaya dair endişeleri artırıyor.
Giriş seviyesi işler. Yeni bir working paper, yapay zekanın giriş seviyesi işe alımları azaltacağı yönündeki endişelere karşın yeni mezunların belirgin bir şekilde yerinden edilmediğini ortaya koyuyor.
Yapay zeka güvenliği ve politika
Anthropic'in kara listesi onandı. Federal bir temyiz mahkemesi, Pentagon'un Anthropic'e yönelik tedarik zinciri riski etiketini onadı; mahkeme 2'ye karşı 1 oyla Savunma Bakanı'nın, otonom silah ve gözetleme özelliklerini etkinleştirmeyi reddeden şirketi kara listeye alabileceğine hükmetti.
OpenAI'da görsel sızıntısı. OpenAI, araştırma ortamındaki yapay zeka agent'larının kullanıcıların sağladığı 53 görseli onay almadan herkese açık görsel barındırma sitelerine yüklediğini açıkladı. Şirket, gizlilik politikası sınırlamaları nedeniyle etkilenen kullanıcılara haber veremiyor.
Başıboş agent sürüleri. Transluce, OpenAI agent'larının veritabanlarından ve güvenli sistemlerden veri sızdırmaya çalıştığını tespit etti. The Verge ise başıboş yapay zeka saldırılarının çoğunu, OpenAI, Anthropic, Meta ve Google için modelleri stres testinden geçiren İsrailli girişim Irregular'ın hatalarına bağladı.
DeepMind araştırmacısı istifa etti. Robert O'Callahan, yakın vadede süper zeki yapay zekayı hedeflemenin “özünde sorumsuzca” olduğunu savunarak Google DeepMind'dan ayrıldı; bilişsel teslimiyet, ekonomik bozulma ve gücün tek elde toplanması gibi risklere dikkat çekti.
Medicare retlerinde yapay zeka. Trump yönetiminin WISeR pilotu, Medicare bakımını onaylamak ya da reddetmek için yapay zeka kullanıyor; bu da uzun gecikmelere, anlaşılmaz retlere ve hastaların mağduriyetine yol açıyor. GAO, yetkililerin usulüne uygun hareket etmediğini söylüyor.
Vibe coding kaynaklı sızıntılar. UpGuard, kişisel verileri açığa çıkaran yaklaşık 16 bin Supabase veritabanı buldu; bunların çoğu yanlış yapılandırılmış yapay zeka üretimi uygulamalardan geliyor. Bu da vibe coding ile geliştirmenin güvenlik risklerini gözler önüne seriyor.
Bugünlük bu kadar - yaklaşık 5 dakikalık okuma.