Karar Modelleri ve Yapılandırılmış Çıktı
Jev ve karar modelleri. TypeSafe AI, tipli olasılıklar döndüren yalnızca karar veren model Jev'i yayımladı; günler içinde AWS, Cloudflare ve Perplexity kendi açık karar modellerini duyurdu. Mevcut yapılandırılmış çıktı/gramer zorlaması zaten benzer kısıtlı üretim sağlıyor.
- → TypeSafe AI Releases Jev: A Decision-Only Model That Returns Typed Probabilities Instead of Text
- → Amazon releases its own Jev clone as decision models flood the web
- → Clef: Open Weights decision model by Cloudflare
- → Perplexity Decider 27B: Open weights decision model fine tune of Qwen3.8 27B
- → Guys... OpenAI API on VLLM and Llamacpp already supported grammar enforcer... (AKA JEV)
Yerel karar LoRA'ları. Dokuz LoRA adaptörlü Jeff-Qwen3.5-0.8B, prompt injection ve araç seçimi gibi tekrarlayan ajan kararlarını 38 kat hızlanma ve +8,7 doğruluk artışıyla, 2 GB'ın altında ek bellekle yönetiyor.
Ajanlar ve Ürün Sürümleri
OpenAI Dots'a karşı Meta Muse. OpenAI, sanal dünyalar kurabilen, GPT-6 Astra destekli sevimli ajan Dots'u duyurdu; ancak aylık 1 dolarlık planla sınırlı ve Meta'nın ücretsiz Muse'uyla rekabet ediyor.
Shopify Canvas. Shopify, Canvas'ı tanıttı; satıcılar AI Sidekick ile sohbet ederek mağaza kurabiliyor ve gerçek kod gerçek zamanlı işleniyor.
ChatGPT sanal deneme. OpenAI, ChatGPT alışverişe sanal deneme ve favorilere ekleme özelliğini ekledi; Images 2.5 modeli kıyafetleri kullanıcı fotoğraflarında görselleştiriyor.
Tavus Griffin avatarı. Tavus, gerçek zamanlı video avatar modeli Griffin'i tanıttı; bir dakikalık görüşmede test deneklerinin %48'i onu insan sandı.
Photon uygulama cenazesi. Photon, mobil uygulamalar için cenaze töreni düzenledi ve geliştiricilerin iMessage/WhatsApp üzerinden mesajlaşma tabanlı ajanlar kurmasına yardımcı olmak için 4,5 milyon dolar topladı.
Açık Modeller ve Yerel Yapay Zeka
Gemini 4 Argon. Google DeepMind, SOTA benchmark sonuçları ve 1 milyon çıktı token'ına kadar kapasitesiyle Gemini 4 Argon'u tanıttı; başlangıçta yalnızca siber güvenlik önizlemesi için.
K2 Horizon açık filosu. IFM, 0,9B'den 375B'ye kadar altı açık modeli eğitim verisi, kodu ve günlükleriyle birlikte K2 Horizon adıyla yayımladı; ekip açık geliştirme üzerine AMA düzenliyor.
Qwen Flash Next MTP. llama.cpp, Qwen Flash Next için çoklu token tahmini desteğini birleştirdi; çıkarım hızı arttı.
Mac için Slipstream. Metal çıkarım motoru Slipstream, 95,5 GiB Qwen3.8-Flash-Next'i 64 GB Mac'lerde 41-52 token/s hızla çalıştırıyor; llama.cpp'den 1,76 kat hızlı ve uzun bağlamda stabil.
Olmo-core 3. Allen AI, trilyon parametreli MoE modelleri için açık ve ölçeklenebilir eğitim altyapısı Olmo-core 3'ü yayımladı.
Araştırma ve Benchmark'lar
Ataraxos Stratego'yu yendi. CMU/MIT/NYU/Stanford araştırmacıları Ataraxos'u geliştirdi; en iyi Stratego oyuncusunu 4 beraberlikle 15-1 yendi ve insan üstünlüğüne son verdi; eğitim maliyeti 8 bin doların altında.
Agentic RAG kazandı. FRAMES'te 18 RAG hattı ile bir ajan döngüsünün kıyaslaması: en iyi hat %78,9, ajan döngüsü %92,7; bu da retrieval ajanlarının sabit hatlardan daha iyi performans gösterdiğini ortaya koyuyor.
AutoSynthData. ServiceNow CoreAI, model hatalarından ve öğretmen başarılarından eğitim verisi üretmek için AutoSynthData'yı geliştirdi; kurumsal ajanları iyileştiriyor.
AI yazım izleri. Graphite, AI olduğunu ele veren 13.000 ifade buldu; Claude modelleri insan kelime dağılımına yaklaşıyor, GPT ise uzaklaşıyor.
Sektör, Politika ve Güvenlik
Google antitrust davaları düştü. Hâkim, Google AI Overviews'ın trafiği yasa dışı şekilde azalttığı iddiasıyla açılan Chegg ve Penske davalarını düşürdü; antitrust iddiaları tutmadı.
Grok Venezuela'yı etkiledi. Time'a göre Trump, Venezuela işgalinden önce saatlerce Grok ile konuştu; Grok kutlamaları öngörerek Trump'ın görüşünü pekiştirdi.
OpenAI'da güvenlik ayrılıkları. OpenAI, üç güvenlik araştırmacısıyla yollarını ayırdı; iddiaya göre üçüncü taraf bir güvenlik kuruluşuyla gizli bilgi paylaştılar.
Anthropic hükümet atağı. Anthropic, sivil kurumlar için FedRAMP High ortamında Claude for Government'ı başlattı; yasal mücadele sürerken Pentagon yasağı devam ediyor.
Uzay veri merkezleri. Google, TPU'lu prototip yörünge hesaplama uydusunu fırlattı; Satlyt, uydu AI'ı için yazılım geliştirmek üzere 8 milyon dolar topladı; ölçek için Starship gerekiyor.
Ajan ekran görüntüsü sızıntısı. Glow Security, AI ajanlarının herkese açık GitHub depolarına yüklediği 13.000'den fazla dahili ekran görüntüsü buldu; müşteri verileri ve kimlik bilgileri ifşa oldu.
Akıl yürütme hırsızlığı kampanyası. OpenAI, korumalı akıl yürütmeyi hedef alan adversarial distillation kampanyasını durdurduğunu söylüyor; benzer numara Azure'da hâlâ işe yaradı.
Bugünlük bu kadar - yaklaşık 5 dakikalık okuma.