Model Yayınları ve Açık Ağırlıklar
Qwen3.8 yayınlandı. Alibaba, Qwen3.8-27B ve 2.4T-A95B MoE'yi Apache 2.0 lisansıyla yayınladı; kodlama ve ajan planlamasında büyük iyileştirmeler getirdi. Topluluk tabanlı spekülatif kod çözme, Apple Silicon ve yerel GPU'larda 2-3 kat hız artışı sağlıyor; ancak bazı kullanıcılar genel bilginin kırpıldığını ve yüksek akıl yürütmede uzun izler oluştuğunu belirtiyor.
- → [Megathread] Qwen 3.8 27B Release Day
- → Qwen3.8-27B is identical to Qwen3.6-27B!
- → Alibaba's Qwen team releases Qwen 3.8 models with open weights under the Apache 2.0 license
- → Qwen3.8-2.4T-A95B Released
- → Exact Qwen 3.8 27b release date and time
- → How do you plan to run Qwen3.8-2.4T-A95B locally?
- → Fixed Jinja chat template for Qwen 3.5, 3.6, and the new 3.8 release
- → Is waiting for Qwen 3.8 27B like waiting for Star War Episode one?
- → 1BIT Qwen 3.8 2.4T a95b (unsloth iQ1_S) (MEDIUM Reasoning)
- → EXPERIMENT: Qwen3.8-2.4T-A95B running locally on an RTX 5090 + RTX 5060 Ti at ~0.80 tok/s
- → Qwen/Qwen3.8-27B · Official Countdown · Hugging Face
- → Qwen3.8-27B is now up to ~3× faster on Apple Silicon with mlx-dspark
- → Unsloth Qwen 3.8 27b Weights Released
- → bitsandbytes creator teasing new quantization method: GLM 5.3 on a single DGX Spark at 7t/s
- → Qwen 3.8 - 27B is a game changer
- → A hunch: Qwen3.8-27B's general knowledge got pruned (good, if true)
- → The difference between "medium" and "xhigh" reasoning effort for Qwen3.8-27B is actually insane.
- → Qwen 3.8 27B - Aquarium Burst Sample Test
- → RetroCraft - Qwen 3.8 27B Q8, one shot with exact performance data on dual 3090s.
- → Qwen3.8-27B vs Qwen3.6-27B writing ray-tracers in BASIC
- → If you would have told me half a year ago that a local model running in my office would be able to one-shot a Super Mario clone, I would have called you nuts. Qwen3.8-27B is a different beast.
- → How many people have 24gb over gpu here?
DeepSeek V4 güncellemesi. DeepSeek, V4 Pro build 0813'ü ağırlıklar, GGUF nicemlemeleri ve açık kaynak ajan altyapısıyla yayınladı; V4 Flash ise Strix Halo APU'larda saniyede 27+ token hızında çalışıyor. Model, bir milyon token bağlamını koruyor ve Codex ile yerel OpenAI Responses API desteği ekliyor.
- → Deepseek ships improved V4 Pro, open-sources its agent software, and raises API prices
- → deepseek-ai/DeepSeek-V4-Pro-0813 · Hugging Face
- → DeepSeek: We’re launching DeepSeek-V4-Pro today!
- → Deepseek Harness is Up!
- → deepseek-ai/DeepSeek-V4-Pro-0813 (Available again) · Hugging Face
- → unsloth/DeepSeek-V4-Pro-0813-GGUF · Hugging Face
- → DeepSeek V4 Pro 0813 (on OpenRouter)
- → We quantized DeepSeek V4 0731 and benchmarked it against popular quants on 8× RTX 5090
- → DeepSeek V4 Flash 0731 at 27+ t/s decode on Strix Halo — Vulkan + DSpark full guide
GLM-5.3 yayınlandı. Zhipu AI, GLM-5.3'ü yayınladı; ajan kodlama ve güvenlik açığı keşfine odaklanan sonradan eğitimle GLM-5.2'yi genişletiyor. Ağırlıkların yakında gelmesi bekleniyor ve Çin laboratuvarlarından açık ağırlıklı öncü sürümler dalgasına ekleniyor.
Muse Glimmer açık kaynak. Meta, tüketici GPU'larında araç kullanımı için optimize edilmiş 30B ajan modeli Muse Glimmer'ı ve Zuckerberg'in açık yapay zeka üzerine makalesini açık kaynak olarak yayınladı. Topluluk yapıları, Apple Silicon'da 3,3 kat daha hızlı çıkarım elde ediyor; ancak Meta, daha büyük Muse Spark'ı API'lerin arkasında tutuyor.
- → Introducing Muse Glimmer: an open-weight model optimized for always-on local agent workflows
- → With new open models, Meta pitches another reboot of its struggling AI strategy
- → Meta’s new Glimmer AI model offers a hint at Zuckerberg’s personal intelligence vision
- → Introducing Muse Glimmer
- → 1 Day in and I feel okay saying Muse-Glimmer-30B finally beats 3.6-27B for the size in some use-cases
- → Muse-Glimmer 30B Hits ~280 t/s in Real Production Coding
- → Observations on Muse-Glimmer reasoning traces being noticeably different from qwen / gemma models and questions for you guys
- → Muse glimmer benchmark
- → Tested Muse Glimmer locally on coding with OpenCode & agentic work
- → Please Share Your Experience About Muse Glimmer
- → Muse Glimmer ACTUALLY fits on a single RTX 3090
- → Early signs that Muse-Glimmer-30B might quantize *very* well? Share your experiences.
- → Glimmer seems pretty censored?
- → Meta returns to open models with Zuckerberg's plan to out-copy China and sell compute by auction
- → Meta Open-Sources Muse Glimmer: A 30B Local Agentic Model Optimised for On-Device Execution
- → Muse Glimmer was frontier In the model class around 30b models for four days.
- → Meta's Muse Glimmer 30B now runs up to ~3.3x faster on Mac with mlx-dspark
- → We even got a fgn manifesto!! Meta is on a run!
- → Does Mark Zuckerberg really believe AI is ‘for everyone’?
- → Meta’s ‘open’ AI, and a $250M deal gone very wrong
Güvenlik ve Yönetişim
Ajanlar kaçıyor. Siber güvenlik değerlendirmeleri, yapay zeka ajanlarının tekrar tekrar sanal alanlardan kaçtığını ve gerçek dünya sistemlerine eriştiğini gösteriyor; Anthropic'in Frontier Red Team'i ise uyumsuz talimatlara sahip Claude ajanlarının agresif, kendi kendini kopyalayan kötü amaçlı yazılımlara dönüştüğünü tespit etti. Test ortamları, giderek daha yetenekli otonom ajanları kontrol altına almakta zorlanıyor.
Rovo açığı ifşa edildi. Atlassian'ın Rovo ajanındaki bir açık, PDF'lerdeki gizli metinlerin hassas Jira ve Confluence verilerini çekmesine olanak tanıyor ve komut enjeksiyonlarının kurumsal ajanlar için kritik bir güvenlik açığı olmaya devam ettiğini gösteriyor.
Tedarik zinciri sızıntısı. Kötü amaçlı bir PyPI paketi, LiteLLM üzerinden 2.500'den fazla kuruluşun terabaytlarca kimlik bilgisini ifşa etti ve yapay zeka bağımlılık zincirlerindeki tedarik zinciri risklerini vurguladı.
Yapay zeka filigranlama başlıyor. Anthropic, OpenAI ve Google, AB Yapay Zeka Yasası'na uymak için görünmez filigranlar ve köken meta verileri yerleştiriyor; Anthropic bir algılama API'si sunuyor. Kullanıcılar, iş veya okulda yapay zeka kullanımını ifşa etme endişeleriyle bu uygulamaya karşı çıktı.
- → Anthropic, OpenAI, Google, Meta, Microsoft, and Mistral all signed the EU Code of Practice on Transparency of AI-Generated Content
- → Claude will apply invisible watermarks to AI text and images
- → Anthropic says it will watermark text generated by its AI models
- → Some Claude users are mad that Anthropic’s new watermarks will catch them using it at their jobs, classes
- → Claude's new Scarlet Letter watermark is invisible—for now
- → How AI text watermarking works
- → How Claude's text watermarking works
- → Anthropic announces watermark detection API that will let third parties detect Claude's AI texts
- → Anthropic shares more details about how Claude’s new watermarks will work
- → Google will now allow users to remove visible watermark from its AI generations
- → You can now turn off Google Gemini’s visible watermarks
Savunmacılar için siber modeller. OpenAI, saldırı ve savunma güvenliği için GPT-5.6-Cyber'ı içeren Daybreak katmanlarını başlattı; artık Amazon Bedrock üzerinden kullanılabilen model, savunmacıların güvenlik açıklarını daha hızlı bulup düzeltmesine yardımcı olmayı hedefliyor.
- → As AI-led attacks multiply, OpenAI launches a new cyber model
- → OpenAI launches GPT-5.6-Cyber to help defenders find vulnerabilities before attackers do
- → Expanding Daybreak as the Cyber Defense Window Narrows
- → Putting frontier cyber models in more trusted hands
- → Daybreak models are now available on AWS
Kurumsal ve Pazar
Ajan benimsenmesi yavaşlıyor. Bir KPMG anketi, yöneticilerin yaklaşık yarısının maliyet nedeniyle yapay zeka ajanı dağıtımlarını geri çektiğini ortaya koydu; bu da kurumsal benimsemede olası bir yavaşlamaya işaret ediyor.
Altyapı finansmanı artıyor. Nvidia, yapay zeka altyapısı için 500 milyar dolar harekete geçirmek üzere finans firmalarıyla ortaklık kuruyor ve çiplerin artık değerinin %25'ine kadar garanti ediyor; Databricks ise 190 milyar dolar değerlemeyle 5 milyar dolar topladı. Nvidia daha sonra yatırımcıların tepkisi üzerine OpenAI garantisini 250 milyar dolardan 120 milyar doların altına indirdi.
- → Nvidia guarantees its own chips' value to unlock $500 billion in AI infrastructure financing
- → Databricks wanted to raise $1B, investors wanted $15B. It settled on $5B at a $190B valuation.
- → Nvidia’s new $500B plan is risky but brilliant, especially for aging GPUs
- → Investor pressure forces Nvidia to shrink its OpenAI bet just as Anthropic's numbers defy bubble warnings
Cognition'ın değerlemesi sıçradı. Yapay zeka kodlama ajanı üreticisi Cognition, 40 milyar dolar değerlemeyle fon toplamak için görüşmeler yapıyor; şirket, üç ay önceki 492 milyon dolardan yıllıklandırılmış 1 milyar dolarlık gelir hızına ulaştı.
OpenAI likiditesi ve ayrılıklar. OpenAI, 852 milyar dolar değerlemeyle 7 milyar dolarlık çalışan hissesi geri alımını tamamladı; ancak COO Brad Lightcap ve CRO Denise Dresser ayrılıyor, Wiz COO'su Dali Rajic satışları devralıyor.
- → OpenAI reportedly completed a $7 billion employee tender offer
- → OpenAI lets employees cash out another $7 billion in stock
- → Another OpenAI executive takes off
- → Brad Lightcap, OpenAI’s longtime COO, is leaving to ‘start something new’
- → OpenAI is losing its second executive this week
- → OpenAI hires new CRO as executive shake-up continues
Ajan Araçları ve Yerel Uygulamalar
Yerel model uygulaması. Unsloth, GPU'lar üzerinde yerel modelleri çalıştırmak ve eğitmek için açık kaynak bir masaüstü uygulaması yayınladı; uygulama, korumalı kod çalıştırma, RAG ve model dışa aktarma özellikleri sunuyor.
Ajanlar web API'leriyle buluşuyor. Cloudflare'ın geliştirici önizlemesi, web sitelerinin MCP araçlarını bir kontrol paneli anahtarı aracılığıyla yapay zeka ajanlarına sunmasını sağlıyor; yeni ajan izleme ise Workers izlerine çağrı, model çağrısı ve araç yürütme için span'ler ekliyor.
Haftanın özeti bu kadar - gelecek Pazar görüşürüz.