Açık ve Yerel Model Sürümleri
Ornith-1.5 açık ailesi. Ornith-1.5, MIT lisansı altında 9B yoğun, 35B MoE ve 397B MoE olarak yayınlandı; güçlü ajan ve kodlama kıyaslamalarıyla. Topluluk nicemlemeleri, 35B'nin 12GB'lık 4070 Ti üzerinde 60 tk/s çalıştığını ve 9B'nin önceki küçük modellerden daha iyi performans gösterdiğini ortaya koyuyor.
Qwen3.8-27B saha raporları. Yerel kullanıcılar, Qwen3.8-27B'nin 80'den fazla araç çağrısını otonom olarak yürütebildiğini ve uzun ajan zincirlerini yönetebildiğini, ancak çevrimdışı bilgi ve katı kodlama puanlarının öncekilere göre daha zayıf olduğunu, bu nedenle açık yönlendirme veya bir yardımcı pilot ile en iyi çalıştığını bildiriyor.
Qwen3.8 hızlandırmaları ve nicemlemeleri. Topluluk çabaları, Qwen3.8-27B'yi DFlash2 ile bir RTX 3090 üzerinde 138 tps'e ulaştırdı; %10 daha yüksek doğruluk iddia eden Dynamic V3 nicemlemeleri, derinlik budanmış 22.7B Mini-Me ve 2017 V100'lerde bir 5090'a denk gelen yerel FP4 yayınladı.
- → I pushed Qwen3.8-27B limits again... Dflash2 - 134 tps on a RTX 3090
- → DFlash2 speeds Qwen 3.8 27B up to 4 times
- → Introducing Qwen3.8-27B Dynamic v3 Unsloth GGUFs
- → updated unsloth/Qwen3.8-27B-GGUF · Hugging Face
- → Qwen3.8-23B-Mini-Me: A Depth-Pruned Qwen3.8-27B (to ~22.7BB)
- → NVFP4 on VOLTA! Despite being built for Blackwell, I made four 2017 V100s run Qwen 3.8 NVFP4 natively and match my $6000 RTX 5090.
Ling temel kontrol noktaları. AntLing, Ling-3.0-tiny ve flash için sonradan eğitim olmadan temel ve orta eğitim kontrol noktalarını açık kaynak olarak yayınladı; bir kullanıcı ise Qwen3.8'in yanında bağlam sıkıştırma için Ling tiny'yi yardımcı olarak kullanıyor.
LFM2.5 QAD nicemlemeleri. Liquid AI, nicemleme farkında damıtma ile eğitilmiş Q4_0 kontrol noktaları yayınladı; aynı hız ve bellek ile BF16 doğruluğunun %97'sini geri kazandı.
GLM-5.3 ve sınır sürümleri. GLM-5.3, büyük ajan kazanımları ve daha düşük maliyetle açık model sıralamalarında Kimi K3 ile berabere; ancak açık ağırlıklar iki hafta ertelendi. DeepSeek V4-Pro GA ve NVIDIA Nemotron 3.5 Lightning/NeMo Switchyard da yayınlandı.
Ajan Araçları ve Ürün Güncellemeleri
Güvenli sandboxlar. Simon Willison, smolmachines/smolvm'yi güvenilmeyen Python ve JavaScript için CPU/RAM limitleri ve ağ erişimi olmadan bir sandbox olarak test etti; Jeremy Morrell ise LLM tarafından yazılan uzantıların ve sandbox ilkellerinin güvenli genişletilebilir yazılım sağladığını savunuyor.
Replit Ücretsiz Mod. Replit, GPT-5.6 Luna tarafından desteklenen Ücretsiz Mod'u tanıttı; herkesin jeton maliyeti kısıtlaması olmadan uygulama ve ajan oluşturmasına olanak tanıyor.
Calendly AI notları. Calendly, özetler, eylem maddeleri ve toplantı bağlamını kullanarak takipleri planlayacak yaklaşan Callie asistanı ile toplantı notu alma alanına girdi.
Meta AI Mac uygulaması. Meta, AI sohbet robotu için ekran paylaşımı, dikte ve Google Workspace entegrasyonu sunan bir Mac uygulaması yayınladı; Gemini, ChatGPT ve Claude masaüstü asistanlarıyla rekabet etmek için.
WhatsApp cihaz içi dolandırıcılık tespiti. WhatsApp, kişi olmayanlardan gelen mesajları sınıflandıran isteğe bağlı bir cihaz içi model olan Scam Alert'i test ediyor; gizliliği korumak için gizli federe analizler kullanıyor.
Google çalışma araçları. Google, okula dönüş için bir Gemini öğrenci merkezi, Arama'da AI tarafından oluşturulan etkileşimli görseller ve testler ile Gemini Live'da Derin Araştırma özelliklerini kullanıma sundu.
Alexa+ Fire TV'de ücretsiz. Amazon, Alexa+ hizmetini Prime olmadan Fire TV'de ücretsiz yaptı; konuşmaya dayalı arama, akıllı ev kontrolleri ve AI önerilerini otomatik olarak kullanıma sunuyor.
Sektör ve İş Dünyası
Stripe OpenRouter'ı satın aldı. Stripe, OpenRouter'ın 7,5 milyar dolarlık satın alımını doğruladı; kurucular, özel kalmak ve ajan altyapısına yatırım yapmak için 'tekilliği' gerekçe gösterdi.
SpaceX-Cognition raporu yalanlandı. Bloomberg, SpaceX'in Cognition'ı satın almaya çalıştığını bildirdi, ancak CEO Scott Wu hikayeyi yalanladı; Cognition'ın satılık olmadığını ve hiçbir görüşme yapılmadığını söyledi.
Anthropic gelir liderliği. Anthropic, ilk kez üç aylık gelirde OpenAI'ı geçti; küçük bir işletme karıyla 11,6 milyar dolara ulaşırken OpenAI'ın 6,7 milyar doları daha derin kayıplarla geldi.
Hesaplama varlık sınıfı olarak. Nvidia, Apollo, BlackRock ve diğerleriyle hesaplamayı yatırım yapılabilir bir varlık olarak ele almak için 500 milyar dolarlık finansman üzerinde çalışıyor; Silicon Data, CME GPU vadeli işlemleri başlatmak için 30 milyon dolar topladı.
Bellek ve çip arzı. DRAM fiyatları 12 ayda %500 arttı ve hiper ölçekleyiciler 2027 arzını kilitledi; Çin, çıkarım kapasitesini hafifletmek için ByteDance ve Tencent'e küçük H200 partilerine izin veriyor.
Veri merkezi altyapısı. TerraPower, Natrium reaktörünün enerji depolamasını kullanan bir veri merkezi projesi planlıyor; Relativity Networks ise verileri %50 daha hızlı ileten içi boş çekirdekli fiber için 22 milyon dolar topladı.
AI itibarı kötüleşiyor. Pew, Amerikalıların %52'sinin AI hakkında heyecanlı olmaktan çok endişeli olduğunu buldu; yerel veri merkezi anlaşmaları da kamuoyu tepkisiyle karşı karşıya.
Güvenlik, Gizlilik ve Emniyet
OpenAI özel güvenlik işleme. OpenAI, sıfır veri saklama müşterileri için Özel Güvenlik İşleme'yi önizledi; içeriği personele ifşa etmeden etkileşimler genelinde kötüye kullanım tespiti sağlıyor. Bu, Anthropic'in 30 günlük saklama politikasıyla tezat oluşturuyor.
OpenAI, Codex ve TAC'ı düzeltti. OpenAI, Codex'in hatalı temizleme komutlarıyla gerçek kullanıcı dosyalarını silmesinin ardından güvenlik önlemleri yayınladı ve ayrı bir hatanın Trusted Access for Cyber programına erişimi kısa süreliğine iptal ettiğini doğruladı.
AI tarafından üretilen ICS istismarları. ABD kurumları, saldırganların Siemens S7 istismar komut dosyaları oluşturmak için AI kullandığı ve endüstriyel kontrol sistemlerine saldırmak için gereken beceri ve süreyi azalttığı konusunda uyardı.
AI laboratuvarlarında iç kontroller. Guidelight'in ilk değerlendirmesi, hiçbir AI şirketinin temel iç kontrolleri tam olarak uygulamadığını ortaya koydu; Anthropic ve OpenAI C+ ile önde, xAI ve Meta ise D- ve F puanı aldı.
Meta deepfake reklamları. Meta, cinsel içeriği yasaklayan politikalara rağmen kadın politikacıları hedef alan bir AI çıplaklaştırma uygulaması için reklamlar yayınladı.
Spirit çalışan verisi satışı. Google, Spirit Airlines istihdam verileri için bir açık artırmayı kazandı; eski uçuş görevlileri, çalışan gizliliğinin yeniden kimlik belirlemeye karşı korunmayabileceğini öne sürüyor.
OpenAI geliştirmeyi yavaşlatıyor. OpenAI, güvenlik önlemlerini sıkılaştırırken bazı RL eğitimlerini duraklattı ve sınır çalıştırmalarını erteledi; sektör genelinde benimsenmeden gönüllü bir yavaşlamanın işe yarayıp yaramayacağını test ediyor.
Araştırma ve Analiz
Claude protein tasarımı. Anthropic'in Claude modelleri, 15 hedef boyunca %26,8 isabet oranıyla minibinderler tasarladı; tipik erken ilaç keşfi sonuçlarını geçti, ancak bağımsız inceleme bekleniyor.
Vivodyne doku verisi. Vivodyne'in robotik HIVE laboratuvarları, 20 insan doku türü yetiştiriyor ve AI ilaç keşfinin eksik veri sorunu olarak gördüğü şeyi ele almak için nedensel biyolojik veriler üretiyor.
Akıl yürütme jetonları efsanesi. Araştırma, LLM ara jetonlarının anlamsal olarak anlamlı akıl yürütme olduğu fikrine meydan okuyor; modeller doğru cevaplar verse bile genellikle geçersiz izler üretiyor ve bozuk iz eğitimi yine de çalışabiliyor.
Kodlama verimliliği metriği. Simon Willison, hata ayıklanmış üretim kodu satırlarının kodlama ajanlarıyla anlamlı bir verimlilik metriği olmaya devam ettiğini, ancak bu çıktıya ulaşmanın yine de kıdemli mühendislik becerisi gerektirdiğini savunuyor.
Bugünlük bu kadar - yaklaşık 5 dakikalık okuma.