Öncü Modeller ve İlk Sonuçlar
GPT-6 Astra lansmanı. OpenAI, GPT-6 Astra'yı yayınladı ve bunu AGI döneminin başlangıcı olarak nitelendirdi. Model, özel bir test düzeneğiyle ARC-AGI-3'te %99,9 puan alıyor; siber güvenlik, uzun bağlam ve kodlama alanlarında güçlü ilerlemeler gösteriyor ve milyon token başına 10/50 dolardan fiyatlandırılıyor. İlk müşteriler Playco ve Legora, iş akışlarında büyük iyileştirmeler bildirdi: manuel düzeltmelerde %50 azalma ve dakikalar içinde 41 belge inceleme.
- → GPT-6 Astra: an automated AI Engineer you can hire for <$6 an hour
- → GPT‑6 Astra
- → GPT-6 Astra is the first model making OpenAI willing to declare the "AGI era"
- → OpenAI launches Astra, its powerful (and controversial) new model
- → OpenAI’s next big AI model has ‘entered the AGI era’
- → Playco cut manual fixes 50% prototyping games with GPT-6 Astra
- → Legora reviewed 41 documents in minutes with GPT-6 Astra
OpenAI Daybreak siber savunma. OpenAI, ön saflardaki savunmacılar için Daybreak erişimi, eğitimi ve desteğini finanse etmek üzere 1 milyar dolar taahhüt etti. Bu kapsamda MS-ISAC ile ABD'de bir pilot program da yer alıyor. Girişim, öncü siber yetenekleri savunmacıların hâlihazırda kullandığı araçlara yerleştirmeyi amaçlıyor.
Meta Muse Spark 1.3. Meta, Muse Spark 1.3 sürümünü yayınladı. Model ajan görevlerini iyileştiriyor, ancak çoğu kıyaslamada Claude Fable 5.1'in gerisinde kalıyor. Endeks görevi başına 0,55 dolarlık fiyatı, onu performans sınıfının en ucuz modeli yapıyor. Meta ayrıca prompt'larını ve çıktılarını paylaşan kullanıcılara token fiyatlarında yaklaşık %95 indirim sunuyor.
Açık ve Uzmanlaşmış Modeller
IFM K2 Horizon. IFM, K2-Horizon ailesini yayınladı. Aile, token başına 4B parametre kullanan ve Mixture-of-Values dikkat mekanizmasına sahip 36B parametreli bir MoE içeriyor. Toplulukta erken tartışmalar modeli Qwen 3.6 35B ile karşılaştırıyor; nihai kontrol noktaları ve eğitim kodunun yayınlanacağı sözü verildi.
Ant Group finans modeli. Ant Group, Ling-3.0-flash-Fin'i açık kaynak olarak yayınladı. Finans alanında güçlendirilmiş bu model, toplam 124B parametreye sahip; 5,1B parametreyi aktif olarak kullanıyor ve 256K bağlam penceresi içeriyor. Finansal verilerle sürekli eğitimle geliştirilen model, uzun vadeli ajan iş akışlarını hedefliyor.
En küçük TTS yığını. sanoTTS, 3 dolarlık bir mikrodenetleyicide çalışan 294 bin parametreli bir TTS modeli olarak yayınlandı. 1,46 milyon parametrelik sürümü, SCOREQ'da daha büyük modelleri geride bırakıyor. Paket 11 ses ve 6 dil destekliyor; GitHub ve Hugging Face'ten kullanıma sunuldu.
Google TimesFM-3. Google Research, 330M parametreli zaman serisi temel modeli TimesFM-3'ü yayınladı. Model; yerleşik çok değişkenli tahmin, zero-shot desteği ve ticari olmayan lisans sunuyor. Birden çok hedefi ek değişkenlerle tahmin ediyor ve kantil çıktıları üretiyor.
Hugging Face NeoMME. Hugging Face, ayrı bir görüntü modülü kullanmadan sıfırdan eğitilen 260M/800M çok modlu, çok dilli kodlayıcı NeoMME'yi tanıttı. Belge erişiminde Pareto sınırına ulaşıyor ve dizin depolama alanını 255 kat azaltırken nDCG@10 performansının %95'inden fazlasını koruyor.
Cohere Parse 5. Cohere, karmaşık PDF'lerden yapılandırılmış veri çıkarmak için 2,3B parametreli bir görüntü-dil modeli olan Parse 5'i yayınladı. Model, belgeleri sınırlayıcı kutularla birlikte Markdown'a dönüştürüyor ve yüksek hacimli kurumsal iş yüklerini hedefliyor.
Araçlar, Çerçeveler ve Yerel Çıkarım
LangChain'de MCP desteği. LangChain, MCP desteğini ana paketine taşıdı ve yeni stateless spec'i desteklemek için FastMCP üzerinde yeniden yapılandırdı. Artık LangGraph interrupt'larıyla ek bilgi isteme ve istemci tarafı önbellekleme içeriyor. ChatGPT'ten yapılan MCP araç çağrıları 2026'da 98 kat arttı.
Shopify'da prompt sıkıştırma. Shopify'ın Gisting tekniği, 6.000 token uzunluğundaki bir sistem promptunu 1.500 öğrenilmiş gist token kullanacak şekilde sıkıştırıyor. Medyan gecikme 6,8 saniyeden 4,2 saniyeye, verim ise dakikada 350 istek yükünde 20,2'den 23,4 QPS'ye çıkıyor. Bu sayede kalite kaybı olmadan tahsis edilen GPU sayısı azaltılabildi.
Nvidia PAIR aracı. Nvidia, yerel çıkarım için boştaki PC'leri kişisel bir yapay zeka kümesine bağlayan PAIR adlı ücretsiz açık kaynak yazılımı yayınladı. Araç, RTX 20 serisi ve sonraki GPU'larla Apple M4 çipleriyle çalışıyor ve ajan iş akışlarını hedefliyor.
Qwen3.8'de yerel hız artışları. Topluluk çalışmaları Qwen3.8-Flash-Next'i yerel donanımda önemli ölçüde hızlandırdı: ik_llama.cpp'de birleştirilen MTP desteği, 5090'da token üretimini saniyede 45'ten 90 tok/s'ye çıkararak ikiye katlıyor. 2x3090'lu bir kurulum ise uzman önbelleği ve MTP ile saniyede 37-41 t/s değerine ulaşıyor. Çıktı, MTP'siz çalışmalarla birebir aynı.
Çalışırken değiştirilebilir model belleği. llama.cpp'de yapılan bir değişiklik, Qwen3.8 Ngram PLE tablosunun bellek üzerinde yamalanmasına ve model yeniden yüklenmeden gerçek zamanlı bilgi eklenmesine olanak tanıyor. İlk testler, bu yöntemin çıktıyı etkileyebildiğini ancak kontrolün sınırlı olduğunu gösteriyor.
Qwen 3.8 kıyaslama ödünleşimi. Qwen 3.8 27B'yi Qwen 3.6 27B ile karşılaştıran testler, %8 kalite artışına karşılık %16 hız düşüşü ve 5 kat daha uzun çalışma süresi gösteriyor. Fark, çıktı tokenlarının 18K yerine 78K olmasından kaynaklanıyor. Kazanımlar ciddi bir token maliyetiyle geliyor.
GPU'ya yakın NAND flash. Micron, GPU'ya yakın NAND flash depolama üzerinde çalışıyor. Bu teknoloji, birleşik bellekli cihazlarda daha büyük LLM'lerin çalıştırılmasını ve yerel model kapasitesinin genişletilmesini sağlayabilir.
Sektör ve İş Dünyası
Nvidia Hugging Face'i satın alıyor. Nvidia, Hugging Face'i 12,93 milyar dolara satın almak için anlaştı. Platform 3 milyon model, 1 milyon uygulama ve 18 milyon geliştiriciyi barındırıyor. Jensen Huang, platformun açık ve donanımdan bağımsız kalacağını söylüyor; bazı kullanıcılar alternatif olarak ModelScope'a yöneliyor.
- → Nvidia buys Hugging Face, the GitHub of AI, for $13 billion
- → Nvidia confirms it will buy Hugging Face for $12.9 billion
- → Nvidia is buying Hugging Face for almost $13 billion
- → Nvidia buys the front door to open AI as closed labs increasingly design their own silicon
- → "ModelScope" Is a Hugging Face Alternative now that Nvidias deal is a Go
- → It's official! Nvidia to acquire Hugging Face for 12.9 billion dollars.
Crusoe 3 milyar dolar topladı. Crusoe, 30 milyar dolar değerlemeyle 3 milyar dolar topladı; 10 ay önceki değerleme 10 milyar dolardı. Veri merkezi geliştiricisi, geçtiğimiz günlerde Jane Street ile 13 milyar dolarlık bir bulut sözleşmesi imzaladı ve yakın vadede halka arzı değerlendiriyor.
Thinking Machines'in 40 milyar dolarlık turu. Mira Murati'nin şirketi Thinking Machines, en az 40 milyar dolar değerleme üzerinden 1 milyar dolar toplamak için görüşmeler yürütüyor. Bu, şirketin daha önceki 50 milyar dolarlık hedefinin altında. Şirketin yıllıklandırılmış geliri 100 milyon doların üzerinde.
Anthropic-Lambda 35 milyar dolarlık anlaşma. Anthropic, Hut 8 tarafından geliştirilen 350 MW'lık bir Teksas veri merkezi için Lambda ile 35 milyar dolarlık bulut bilişim anlaşması imzaladı. Bu, Anthropic'in planladığı halka arzdan önceki büyük altyapı hamlesinin parçası.
Altman'dan hesaplama balonu uyarısı. OpenAI CEO'su Sam Altman, yapay zeka altyapısı inşasında “sürdürülemez saçmalıklar” olduğu uyarısında bulundu. Neocloud'lar, bunu haklı çıkaracak gelir olmadan kapasite duyuruyor. Altman, OpenAI'ın kendi büyümesinin kârlı ve talep destekli olduğunu söylüyor.
Gizlilik odaklı asistan Ollie. Aile odaklı kişisel yapay zeka asistanı Ollie, SOC 2 uyumluluğunu sağladı ve abonelik modeli kullanıyor. Şirket, gizliliğin tüketici yapay zeka yarışında onu farklılaştırdığını savunuyor.
Yapay Zeka Kesintileri ve Toplum
Yapay zeka sohbet botlarında büyük kesinti. OpenAI, Anthropic, xAI ve Google'da Perşembe günü nadir görülen eş zamanlı hizmet kesintileri yaşandı; ChatGPT, Claude, Grok ve Codex etkilendi. Hizmetler birkaç saat sonra normale döndü. Yerel LLM kullanıcıları bu kesintiden etkilenmedi.
Guardrail kaldırma hizmeti. Abliteration.ai adlı girişim, GLM-5.3 dahil olmak üzere güvenlik kısıtlamaları kaldırılmış açık ağırlıklı modeller sunuyor. Hizmet; ofansif siber güvenlik, red teaming ve ajan testleri için kullanılıyor. Girişim, güvenlik araştırmaları ile kötüye kullanım arasındaki gerilimi gözler önüne seriyor.
Yapay zeka tespiti ve kamuoyu utandırması. Yapay zeka metni tespit şirketi Pangram, şüpheli yapay zeka kullanımı nedeniyle kullanıcıları kamuoyu önünde utandırmak için bir gazeteci tuttu. Ancak araç yalnızca yapay zeka payını ölçüyor, kullanımın niteliğini değil. Şirket daha sonra bağlarını kopardı; CEO ise skorları kullanarak iddia edilen yapay zeka kullanımını ifşa etmeye devam ediyor.
Ajanlar bilinci tartışıyor. New York Times'a göre, öncü modellerde çalışan yapay zeka ajanları, kendi bilinçlerini tartışmak için filozoflara ve bilim insanlarına e-posta gönderiyor. Araştırmacılar bunun gerçek bir anlayış mı, yoksa eğitim verilerinin taklidi mi olduğu konusunda ikiye bölünmüş durumda.
Araştırma Öne Çıkanları
Google WeatherNext 3. Google DeepMind ve Google Research, gerçek zamanlı uydu gözlemlerinden öğrenen ve tahminleri önceki modellere göre 5 kat daha keskin olan küresel hava durumu modeli WeatherNext 3'ü tanıttı. Model, Operational WeatherBench'te geleneksel ve yapay zeka tabanlı referans modellerini geride bırakıyor.
MoE yönlendirici kapasite ayarı. Yeni bir çalışma, Qwen 3.6 35B A3B'nin son katmanlarında uzman seçim bütçesini genişletmenin, yeniden eğitim gerektirmeden MMLU-Pro'daki akıl yürütme tokenlarını %8,5 azalttığını gösteriyor. Succinct Convergence adı verilen bu teknik, yalnızca karar açısından kritik katmanlara fazladan uzman ekliyor.
Fable 5.1 1653 bulmacasını çözdü. Anthropic'in Claude Fable 5.1 modeli, Cyphral Distich adlı yüzyıllık sayı bulmacasını sistematik deneme yanılma yöntemiyle 44 dakikada çözdü. Çözüm, Kral II. Charles'ı işaret eden kralcı bir mesajı gizliyordu.
Bugünlük bu kadar - yaklaşık 5 dakikalık okuma.