डिसीजन मॉडल्स और स्ट्रक्चर्ड आउटपुट
Jev और डिसीजन मॉडल्स. TypeSafe AI ने Jev रिलीज़ किया, एक डिसीजन-ओनली मॉडल जो टाइप्ड प्रोबेबिलिटीज़ लौटाता है; कुछ ही दिनों में AWS, Cloudflare और Perplexity ने अपने खुद के ओपन डिसीजन मॉडल्स रिलीज़ किए। मौजूदा स्ट्रक्चर्ड आउटपुट/ग्रामर एनफोर्समेंट पहले से ही समान कंस्ट्रेन्ड जनरेशन प्रदान करता है।
- → TypeSafe AI Releases Jev: A Decision-Only Model That Returns Typed Probabilities Instead of Text
- → Amazon releases its own Jev clone as decision models flood the web
- → Clef: Open Weights decision model by Cloudflare
- → Perplexity Decider 27B: Open weights decision model fine tune of Qwen3.8 27B
- → Guys... OpenAI API on VLLM and Llamacpp already supported grammar enforcer... (AKA JEV)
लोकल डिसीजन LoRA. Jeff-Qwen3.5-0.8B, नौ LoRA एडाप्टर के साथ, प्रॉम्प्ट इंजेक्शन और टूल चॉइस जैसे आवर्ती एजेंट निर्णयों को संभालता है, 38x स्पीडअप और +8.7 एक्यूरेसी के साथ, 2GB से कम अतिरिक्त मेमोरी का उपयोग करते हुए।
एजेंट्स और प्रोडक्ट रिलीज़
OpenAI Dots बनाम Meta Muse. OpenAI ने Dots की घोषणा की, एक क्यूटसी GPT-6 Astra-संचालित एजेंट जो वर्चुअल वर्ल्ड बना सकता है, लेकिन यह $1/महीने के प्लान तक सीमित है, और Meta के फ्री Muse का सामना कर रहा है।
Shopify Canvas. Shopify ने Canvas लॉन्च किया, जिससे व्यापारी AI Sidekick के साथ चैट करके स्टोर बना सकते हैं, वास्तविक कोड के रीयल-टाइम रेंडरिंग के साथ।
ChatGPT वर्चुअल ट्राय-ऑन. OpenAI ने ChatGPT शॉपिंग में वर्चुअल ट्राय-ऑन और फेवरेटिंग जोड़ा, जो Images 2.5 मॉडल का उपयोग करके उपयोगकर्ता की फोटो पर कपड़ों को विज़ुअलाइज़ करता है।
Tavus Griffin अवतार. Tavus ने Griffin पेश किया, एक रीयल-टाइम वीडियो अवतार मॉडल; एक मिनट की कॉल पर 48% टेस्ट सब्जेक्ट्स ने इसे इंसान समझ लिया।
Photon ऐप का फ्यूनरल. Photon ने मोबाइल ऐप्स का फ्यूनरल रखा और $4.5M जुटाए ताकि डेवलपर्स iMessage/WhatsApp पर मैसेजिंग-आधारित एजेंट बना सकें।
ओपन मॉडल्स और लोकल AI
Gemini 4 Argon. Google DeepMind ने Gemini 4 Argon पेश किया, SOTA बेंचमार्क और 1M तक आउटपुट टोकन के साथ, शुरू में केवल साइबर सुरक्षा प्रीव्यू के लिए।
K2 Horizon ओपन फ्लीट. IFM ने K2 Horizon रिलीज़ किया, 0.9B से 375B तक के छह ओपन मॉडल्स, ट्रेनिंग डेटा, कोड और लॉग्स के साथ; ओपन डेवलपमेंट पर टीम AMA।
Qwen Flash Next MTP. llama.cpp ने Qwen Flash Next के लिए मल्टी-टोकन प्रेडिक्शन सपोर्ट मर्ज किया, जिससे इन्फरेंस स्पीड बढ़ी।
Mac के लिए Slipstream. Slipstream, एक Metal इन्फरेंस इंजन, 64GB Macs पर 95.5 GiB Qwen3.8-Flash-Next को 41-52 tok/s पर चलाता है, जो llama.cpp से 1.76x तेज़ है, स्थिर लंबे कॉन्टेक्स्ट के साथ।
Olmo-core 3. Allen AI ने Olmo-core 3 रिलीज़ किया, ट्रिलियन-पैरामीटर MoE मॉडल्स के लिए ओपन स्केलेबल ट्रेनिंग इन्फ्रास्ट्रक्चर।
रिसर्च और बेंचमार्क्स
Ataraxos ने Stratego को हराया. CMU/MIT/NYU/Stanford के शोधकर्ताओं ने Ataraxos बनाया, जिसने सर्वश्रेष्ठ Stratego खिलाड़ी को 15-1 से हराया, 4 ड्रॉ के साथ, मानव गढ़ का अंत किया; ट्रेनिंग लागत $8k से कम।
एजेंटिक RAG जीता. FRAMES पर 18 RAG पाइपलाइन्स बनाम एक एजेंट लूप का बेंचमार्क: सर्वश्रेष्ठ पाइपलाइन 78.9%, एजेंट लूप 92.7%, जो दर्शाता है कि रिट्रीवल एजेंट्स फिक्स्ड पाइपलाइन्स से बेहतर प्रदर्शन करते हैं।
AutoSynthData टूल. ServiceNow CoreAI ने AutoSynthData बनाया, जो मॉडल की विफलताओं और शिक्षक की सफलताओं से ट्रेनिंग डेटा जनरेट करता है, जिससे एंटरप्राइज़ एजेंट्स में सुधार होता है।
AI लेखन की पहचान. Graphite ने 13,000 ऐसे वाक्यांश खोजे जो AI की पहचान हैं; Claude मॉडल्स मानव शब्द वितरण के करीब हो रहे हैं, GPT दूर।
उद्योग, नीति और सुरक्षा
Google के एंटीट्रस्ट मुकदमे खारिज. जज ने Chegg और Penske के मुकदमे खारिज कर दिए, जिनमें आरोप लगाया गया था कि Google AI Overviews ने अवैध रूप से ट्रैफिक कम किया; एंटीट्रस्ट दावे टिक नहीं पाए।
Grok का वेनेज़ुएला पर प्रभाव. Time की रिपोर्ट के अनुसार, ट्रंप ने वेनेज़ुएला आक्रमण से पहले घंटों Grok से बात की; Grok ने जश्न की भविष्यवाणी की, जिससे ट्रंप के विचार को बल मिला।
OpenAI सुरक्षा विदाई. OpenAI ने तीन सुरक्षा शोधकर्ताओं से अलग हो गया, कथित तौर पर एक तीसरे पक्ष के सुरक्षा संगठन के साथ गोपनीय जानकारी साझा करने के लिए।
Anthropic का सरकारी कदम. Anthropic ने FedRAMP High वातावरण में असैनिक एजेंसियों के लिए Claude for Government लॉन्च किया; कानूनी लड़ाई के बीच पेंटागन पर प्रतिबंध बरकरार है।
अंतरिक्ष डेटा सेंटर. Google ने TPU के साथ प्रोटोटाइप ऑर्बिटल कंप्यूट सैटेलाइट लॉन्च किया; Satlyt ने सैटेलाइट AI के लिए सॉफ्टवेयर बनाने के लिए $8M जुटाए, स्केल के लिए Starship की आवश्यकता है।
एजेंट स्क्रीनशॉट लीक. Glow Security ने पाया कि AI एजेंट्स द्वारा सार्वजनिक GitHub रेपोज़ पर 13,000+ आंतरिक स्क्रीनशॉट अपलोड किए गए, जिससे ग्राहक डेटा और क्रेडेंशियल्स उजागर हुए।
रीज़निंग चोरी अभियान. OpenAI का कहना है कि उसने संरक्षित रीज़निंग को निशाना बनाने वाले एडवर्सेरियल डिस्टिलेशन अभियान को रोक दिया; समान तरकीब अभी भी Azure पर काम कर गई।
आज के लिए बस इतना ही - लगभग 5 मिनट का पठन।