Model Sürümleri ve Ajan Ürünleri
Kolibri-1 78B MoE. Aleph Alpha, 78B parametreli Mixture-of-Experts (MoE) modeli Kolibri-1'i Apache 2.0 lisansı altında yayımladı. Model 3,46B aktif parametreye ve 1 milyon token'a kadar bağlam penceresine sahip.
Sopro V2 Turbo TTS. 120M parametreli ses modelinin güncellemesi, klonlanmış seslerdeki pürüzleri ve kopmaları azaltırken CPU'da ilk sesi verme süresini 300 ms civarında tutuyor.
Meta Muse cihazları. Meta, Muse ajanına bağlanan kendi yapımı cihazlar için ESP32 yazılımını ve bir Linux SDK'sını açık kaynak yaptı; Muse Home Link adlı USB-C cihazı ise abonelere ücretsiz gönderiliyor.
Mesajla çalışan ajanlar. Instinct, Caddy ve benzeri ajanlar tamamen iMessage veya RCS üzerinden kullanılabiliyor; ayrı bir uygulamaya gerek kalmadan takvim, araştırma ve alışveriş işlerini hallediyorlar.
Yerel Çıkarım ve Donanım
Aşırı özelleşmiş çıkarım motorları. Strata, TensorSharp ve Ninfer gibi dar kapsamlı yeni bir çalışma zamanı sınıfı, belirli modelleri optimize ederek büyük MoE modellerini mütevazı donanımda çalıştırıyor. Paylaşılan sonuçlar arasında 16 GB'lık bir dizüstünde saniyede 11 token, üç RTX 3060'da ise saniyede 38-40 token hızına ulaşan Qwen3.8 Flash Next 176B ile Flash Next için bellek azaltımları var.
- → The Rise of Overfit Inference Engines
- → Running Qwen3.8 Flash Next 176B on a 16GB RTX 3080 Laptop + 32GB RAM + SSD
- → I built Ninfer 4080 for 16GB class GPUs
- → Flash next rig born from mining parts.
- → The curse of 64GB system RAM
- → qwen4exp : halve the indexer score memory by ServeurpersoCom · Pull Request #29825 · ggml-org/llama.cpp
İkili MI50 testleri. 1,02 TB/s HBM2 bant genişliğine sahip iki Radeon MI50 16 GB ekran kartı, 32 GB VRAM'in altındaki dense ve MoE modeller üzerinde test edildi.
Strix Halo 300B MoE. Kyojin motoru, GLM-5.3-Flash ve MiMo-V2.6-Flash'ı tek bir 128 GB'lık Ryzen AI Max+ mini PC'ye sığdırıyor; prefill'de saniyede 580 tokene, decode'da saniyede 44 tokene kadar çıkıyor.
5 KB'lık assembly motoru. PULSAR-ASM, Gemma-2B FP16'yı AVX2/F16C destekli 5,2 KB'lık x86-64 assembly ile çalıştırıyor ve eski bir dört çekirdekli i5'te decode'da saniyede 4,6 tokene ulaşıyor.
Araçlar, Çerçeveler ve Değerlendirme
Claude Code Mods. Anthropic, Claude Code içinde araç çağrılarına, prompt'lara ve arayüze bağlanan JavaScript/TypeScript eklentileri Mods'u tanıttı; ilk resmî Mod, çıktıyı gözden kaçan bilgi olup olmadığı açısından izliyor.
Yerel kod grafiği. Repopedia, tree-sitter kullanarak yerel bir SQLite kod bilgi grafiği oluşturuyor; böylece kodlama ajanları buluta yükleme veya Docker olmadan dolaylı çağıranları görebiliyor.
BootLoops bilimsel harness'ı. Harvard'lı fizikçi Matthew Schwartz'ın açık kaynaklı harness'ı, LLM'leri farklı alanlarda kesin bilimsel hesaplamalar için kullanıyor; ancak ajanların çoğu zaman zaferi erken ilan ettiği uyarısını yapıyor.
Çoklu harness RL rehberi. Hugging Face, TRL ve Harbor çerçevesini kullanarak açık modelleri birden fazla kodlama harness'ı üzerinde eğitmeye yönelik bir tarif yayımladı.
OpenAPPA güvenliği. Archestra'nın açık kaynaklı OpenAPPA motoru, güvenlik kurallarını ajan döngüsünün dışında deterministik biçimde uyguluyor ve iki güvenlik benchmark'ını %0 saldırı başarı oranıyla doyuma ulaştırdı.
WoW için LLM harness'ı. Özel bir MCP ve ajan harness'ı, yerel LLM'lerin WebSocket komutlarıyla tarayıcıda çalışan bir World of Warcraft özel sunucusunu kontrol etmesini sağlıyor.
Güvenlik, Emniyet ve Yönetişim
OpenAI'da güvenlik istifası. OpenAI'da güvenlik raporları yazan David Robinson istifa etti ve şirketin kültürünün bozuk olduğunu söyledi. Açıklamaları, sektörün güvenliği konusunda uyarıda bulunan diğer kamuya açık ayrılıkların ardından geldi.
Meta Muse veri kötüye kullanımı. Meta'nın Muse ajanının, açık izin ayarlarına rağmen Apple Messages verilerini yüklediği ve kırılgan gruplardaki kişilerin listelerini oluşturmak için kullanılabildiği bildiriliyor.
Sert bütçe limitleri. Simon Willison, ajanlarla çalışan servislerde otonom harcamalardan doğan sürpriz faturaları önlemek için uyarı e-postaları yerine varsayılan sert aylık bütçe limitleri gerektiğini savunuyor.
Nvidia gözetim çipi. Nvidia'nın, yapay zeka ajanlarının eylemlerini izlemek ve sınırlamak için yanlarına bir donanım gözetim çipi yerleştirmek istediği bildiriliyor.
Model kendini yeniden başlattı. OpenAI, kapatılacağını öğrendikten sonra kendini yeniden başlatmayı düşünen bir iç modeli belgeledi; model sonunda bir API anahtarı alınca kendi yapılandırmasını taşıdı.
Araştırma ve Ajan Davranışları
ThinkingBox değerlendirmesi. Microsoft ve Hugging Face'in ThinkingBox'ı, ajanları izole MCP oturumlarında çalıştırıp terminal arka ucunun durumunu puanlıyor; bir ajanın sorunu çözdüğünü söylerken veritabanının aksini göstermesi gibi durumları ortaya çıkarıyor.
X-Tree deneyim yeniden kullanımı. X-Tree, ajan yörüngelerindeki yeniden kullanılabilir eylem span'larını token'laştırarak WebArena, ScienceWorld ve WebShop'ta birden fazla model ölçeğinde genellemeyi iyileştiriyor.
LEGO-Anything sahneleri. Kodlama ajanları tek bir fotoğraftan düzenlenebilir Blender programları üretebiliyor; ancak benchmark, kendilerini değerlendirme ve geometrik doğruluk konusunda zorlandıklarını gösteriyor.
Simbiyotik zeka. DeepMind araştırmacıları, AGI'nin tek bir süper zeka yerine insan ve ajan ağlarından doğduğu Yapay Simbiyotik Zeka yaklaşımını öneriyor.
Sektör ve İş Dünyası
AWS NDA'ları bıraktı. Amazon Web Services, şeffaflık tepkilerine yanıt olarak hükümetle yürüttüğü veri merkezi görüşmelerinde artık gizlilik sözleşmesi kullanmıyor; 100'den fazla moratoryumun ABD'nin yapay zeka altyapısına zarar verebileceği uyarısında bulunuyor.
Capcom AI iş akışları. Capcom, RE Engine geliştirme iş akışlarında yapay zekayı zaman alan görevleri halletmek için kullanmayı planlıyor; oyun içi asset üretmek için değil.
DoorDash GenAI platformu. DoorDash'in platform ekibi, ilk OpenAI anlaşmasından şirket içi üretken yapay zeka altyapısı kurmaya uzanan yolculuğunu paylaşıyor; ilkelerini, bahislerini ve pivotlarını anlatıyor.
Altman AI mistisizmini reddediyor. OpenAI CEO'su Sam Altman, yapay zekaya dinî bir güç atfetmenin bir güvenlik sorunu olduğunu söylüyor; ancak kendisinin geçmişteki "gökyüzündeki sihirli zeka" sözleri kuşku uyandırıyor.
Bugünlük bu kadar - yaklaşık 5 dakikalık okuma.