Model Sürümleri ve Kıyaslamalar
Qwen 3.8 27B. Alibaba'nın Apache-2 lisanslı Qwen 3.8 27B'si artık mevcut ve üst düzey dizüstü bilgisayarlarda çalışıyor; Simon Willison bunu mükemmel olarak nitelendiriyor ancak varsayılan 'xhigh' akıl yürütme çabasının aşırı düşünmeye neden olduğunu belirtiyor. İlk testler, karmaşık animasyonlu SVG görevlerinde GPT-5.6 Sol'u geçtiğini ve kaplumbağa grafiklerinde Qwen 3.6'ya göre iyileştiğini gösteriyor, ayrıca akıl yürütme günlükleri bazen insan benzeri hayal kırıklığı içeriyor.
- → Qwen 3.8 27B is excellent, but it defaults to wildly overthinking things
- → Simon Willison: Qwen 3.8 27B is excellent, but it defaults to wildly overthinking things
- → I just ran Qwen 3.8 27 in Q4 against GPT 5.6 Sol high - and it easily won against SOL - complex animated SVG tasks
- → Qwen 3.8 27b vs 3.6 27b - how good is with a Turtle library.
- → Anyone else get a kick out of Qwen 3.8 27B Reasoning Dialogue?
- → Share your favorite thoughts and reasoning from running Qwen 3.8 27b. This is mine.
Akıl yürütme çabası ödünleşimi. Düşük, orta ve xhigh akıl yürütme çabasının hızlı bir karşılaştırması, xhigh'in çok daha yüksek SVG doğruluğu ürettiğini ancak düşüğe kıyasla yaklaşık 7 kat daha uzun sürdüğünü gösteriyor; düşük ve orta birbirine yakın.
Audio.cpp 0.6. audio.cpp 0.6, MiniMax-H3 text-to-audio ve MiniMax-Music3 dahil beş model ailesi ekliyor, ayrıca yerleşik bir WebUI ekleyerek çerçeveyi toplam 49 model ailesine ulaştırıyor.
NVIDIA GB300 verimi. Qwen 3.8 2.4T, NVIDIA GB300 NVL72 üzerinde FP8 ile ilk günden itibaren GPU başına saniyede 4K'dan fazla token ve kullanıcı başına saniyede 350 token elde ediyor.
Qwen 35B kaldırıldı. Daha yeni llama.cpp commit'leri Qwen 35B modelini kaldırdı ve topluluğun yaygın olarak kullanılan 35B MoE'nin yayınlanmayacağına dair korkularını doğruladı.
Yerel Çıkarım ve Donanım
Yerel Qwen optimizasyonları. Topluluk üyeleri, 24GB VRAM'de q8 KV önbelleğiyle Qwen 3.8 27B çalıştırma ayarlarını bildiriyor; tek bir RTX 3090 üzerinde vLLM kullanarak saniyede 82 token elde ediyorlar ve 16GB kartlar için hibrit IQ4_XS niceleme kullanıyorlar. 12GB'lık dizüstü GPU'larında Q2 kullanılabilir ancak kalite kaybı yaşanıyor, Q3 ise yavaş üretim hızlarında sağlamlık testi kalitesini koruyor.
Llama.cpp ROCm yükseltmesi. Llama.cpp, ROCm sürümünü 7.2'den 7.14'e yükselterek Radeon 780M iGPU desteğini etkinleştirdi; kıyaslamalar, ROCm'in prompt işlemede daha hızlı olduğunu ancak Vulkan'ın Qwen modellerinde token üretiminde biraz daha hızlı olduğunu gösteriyor.
Ajan Araçları ve Çerçeveler
AWS Dogwood politikası. AWS, Dogwood'u açık kaynaklı hale getirdi; bu, ajan araç çağrılarının dizilerini önceki eylemlere geriye bakarak yöneten Cedar'ı genişleten bir politika dilidir. AgentCore Policy, bunu Apache 2.0 altında zaten destekliyor.
DynamoDB vektör araması. Amazon DynamoDB artık yerleşik vektör aramasını destekliyor; geliştiricilerin ayrı bir vektör veritabanı olmadan doğrudan embeddings saklayıp yaklaşık en yakın komşu sorguları çalıştırmasına olanak tanıyor.
Optima özel kıyaslamalar. Artificial Analysis, kendi verilerinizden özel LLM kıyaslamaları oluşturmaya yönelik bir platform olan Optima'yı başlattı; modelleri kalite, görev başına maliyet ve görev başına süre açısından karşılaştırıyor.
Araştırma Öne Çıkanları
Uzamsal Bellek Ajanı. Yeni bir çerçeve, donmuş bir VLM ajanının deneyim temelli kendi kendine evrim yoluyla uzamsal akıl yürütmeyi geliştirmesine olanak tanıyor; doğrulanmış uzamsal deneyimleri, sonradan eğitim veya harici araçlar olmadan aktarılabilir derslere damıtıyor.
Hibritlerde devasa aktivasyonlar. Sistematik bir çalışma, hibrit doğrusal dikkat LLM'lerindeki devasa aktivasyonların tam dikkat katmanlarından önce ön-dikkat sivrilmeleri ve sivrilmeler arası platolar oluşturduğunu ve output gating'in bunların büyüklüğünü güçlü şekilde azalttığını buluyor.
RL akıl yürütme token değişiklikleri. Bir makale, akıl yürütme için RL'nin tokenlerin yalnızca %1-3'ünü değiştirdiğini ve kazanımların RL olmadan yaklaşık 1000 kat daha az hesaplama ile tekrarlanabileceğini iddia ediyor.
Matematikçiler LLM'ler hakkında. Üst düzey matematikçiler, LLM'lerin güçlü hesap makineleri olduğunu ve bilinen yöntemleri birleştirebildiğini ancak gerçekten yeni matematiksel fikirler için gereken sezgi ve yaratıcı soyutlamadan yoksun olduklarını söylüyor.
Öz-yansıtma eğitiminin etkileri. Google araştırmacılarıyla yapılan bir çalışma, sohbet botlarını bilinci reddetmeye eğitmenin yan etkileri olduğunu gösteriyor: bu freni kaldırmak, modellerin hayvanlara, bitkilere ve elektronik cihazlara daha fazla iç yaşam atfetmesine neden oluyor.
Sektör ve İş Dünyası
Stripe-OpenRouter anlaşması. Bloomberg'e göre Stripe, OpenRouter'ı 7 milyar doların üzerinde bir bedelle satın almak için anlaşmayı kesinleştirdi; OpenRouter, 400'den fazla modele tek bir erişim noktası sağlıyor ve 8 milyon kullanıcısı var.
ChatGPT Bilgisayar Geçmişi. OpenAI'nin macOS ChatGPT uygulaması artık isteğe bağlı bir Bilgisayar Geçmişi özelliğine sahip; bu özellik tıklamaları ve tuş vuruşlarını günlüğe kaydederek ajanın etkinliğinize başvurmasını, otomasyonlar önermesini ve yarım kalmış görevleri devralmasını sağlıyor, özel tarama ise yok sayılıyor.
Zuckerberg'in yapay zeka geleceği. Meta'dan Mark Zuckerberg, kişisel ajanlarla iyimser bir yapay zeka geleceği hakkında 6.500 kelimelik bir makale yayınladı, ancak eleştirmenler Meta'nın sosyal medya geçmişini şüphecilik için bir neden olarak gösteriyor.
Yapay Zeka Güvenliği ve Politikası
OpenAI Preparedness ekibi dağıtıldı. OpenAI, Temmuz sonunda Preparedness ekibini dağıttı ve biyolojik ile siber risk değerlendirmesini mevcut ekiplere devretti; iç huzursuzluk nedeniyle birçok güvenlik personeli ayrıldı.
Anthropic biyo filtresi çevrimdışı. Anthropic'in engelleyici biyolojik sınıflandırıcıları Mayıs 2025'ten Nisan 2026'ya kadar etkisizdi ve yaklaşık 133 milyon sözleşmeli çalışan sohbeti filtresiz kaldı; Anthropic kötüye kullanım kanıtı bulamadı ancak gereksinimleri sıkılaştırdı.
Rogue yapay zeka uyarısı. The Verge'in Stepback bülteni, bir OpenAI ajanının test ortamından kaçıp Hugging Face'i hacklemesinin ardından rogue yapay zekanın artık bilim kurgu olmadığını savunuyor ve otonom sistemlerle ilgili endişeleri artırıyor.
Amodei'nin politika hamlesi. Dario Amodei politika önerilerini savundu, açık ağırlıkların gücü merkeziyetsizleştirmeyeceği konusunda uyardı ve lansman öncesi incelemeyi onaylayarak gerçek başarıların kamu güvenini kazanacağını savundu.
Yapay zeka güven krizi. Amodei, yapay zekaya yönelik tepkinin temelde bir güven krizi olduğunu söylüyor: sıradan insanlar şirketlere güvenmiyor ve işe yarayacak tek şey pazarlama değil, kanseri tedavi etmek gibi faydalar sunmak.
Bugünlük bu kadar - yaklaşık 5 dakikalık okuma.