एजेंट और मॉडल रिलीज़
Qwen 3.8 27B स्कोर. Qwen 3.8 27B ने आर्टिफिशियल एनालिसिस इंटेलिजेंस इंडेक्स पर 52 स्कोर किया, जो GPT-5.6 Luna Max के बराबर है और काफी बड़े GLM-5.2 और DeepSeek V4 Pro से एक अंक पीछे है। यह डिफ़ॉल्ट रूप से xhigh रीज़निंग के साथ आता है, संभवतः बेंचमार्क दृश्यता को अधिकतम करने के लिए।
Qwen एजेंटिक कोडिंग. 16GB VRAM पर, MTP स्पेकुलेटिव डिकोडिंग के साथ क्वांटाइज़्ड Qwen 3.8 27B 30-50 tps पर 73k कॉन्टेक्स्ट संभालता है। स्थानीय बेंचमार्क पाते हैं कि मीडियम रीज़निंग मोड कम टोकन के साथ DeepSeek V4 Flash लगभग मेल खाता है, जबकि xhigh एजेंटिक कोडिंग में स्पष्ट रूप से सुधार नहीं करता है।
- → Optimizing Qwen3.6 / Qwen3.8-27B on 16GB VRAM: Complete Benchmark Results and Setup Guide (~30-50tps at 32k to 72k context)
- → After pushing 1M+ tokens through Qwen 3.8 27B, here is my optimal llama.cpp config for 16GB VRAM (73k Context, Agentic Coding)
- → Local agentic coding Benchmark : Qwen 3.8 27B (in many weights quants / cache quants / engine / reasoning effort) vs others.
35B-A3B अभी भी अस्पष्ट. एक Qwen डेवलपर का कहना है कि 35B-A3B की प्रतीक्षा न करें, भले ही 35B-A3B और 122B के लिए समुदाय की मांग अधिक बनी हुई है और कोई आधिकारिक रिलीज़ संकेत नहीं है।
Ling 3.0 Tiny गति. Ling 3.0 Tiny 8B, 1.3B सक्रिय पैरामीटर के साथ, 4GB VRAM पर 36 टोकन/सेकंड चलता है और Qwen 3.5 9B और Gemma 12 के करीब प्रदर्शन करता है।
GLM-5.3 पोस्ट-ट्रेनिंग. Z.ai ने GLM-5.3 जारी किया जिसमें सुधार पूरी तरह से अधिक पोस्ट-ट्रेनिंग से आया है, जिससे बेहतर जटिल कोडिंग और लंबे-क्षितिज कार्य प्रदर्शन प्राप्त होता है।
Grok Bot एजेंट. SpaceXAI ने Grok Bot पेश किया, समर्पित क्लाउड कंप्यूटरों पर स्थायी AI एजेंट जो बहु-चरणीय वर्कफ़्लो संभालते हैं, प्राथमिकताएँ याद रखते हैं, और समूहों में समन्वय करते हैं।
टूल्स और फ्रेमवर्क
llama.cpp v0.1.0. llama.cpp ने अपना पहला सिमेंटिक वर्जन, v0.1.0 जारी किया, और एक PR एडेप्टिव MTP जोड़ता है जो गतिशील रूप से MTP गहराई चुनता है, कोडिंग जनरेशन में 10-15% सुधार और रिकॉल को 100% तक तेज़ करता है।
एजेंट भुगतान मिडलवेयर. LangChain एजेंटों के लिए AgentCore Payments मिडलवेयर निर्धारित सत्र-स्तरीय बजट और वॉलेट समर्थन जोड़ता है, जिसमें LangSmith रिकॉर्ड करता है कि एजेंटों ने क्या खरीदा और क्यों।
एजेंटिक फिटनेस फ़ंक्शन. एक नया लेख तर्क देता है कि एजेंटिक फिटनेस फ़ंक्शन निर्णय-भारी जोखिमों को संभालकर विकासवादी वास्तुकला का विस्तार कर सकते हैं, जबकि मापने योग्य अपरिवर्तनीयों के लिए निर्धारित गेट बने रहते हैं।
बाधा-जागरूक GPU शेड्यूलिंग. Hugging Face ने एक बाधा-जागरूक GPU आवंटक बनाया जिसने समान हार्डवेयर पर उपयोग को 33 प्रतिशत अंकों तक और प्राथमिकता-भारित आउटपुट को 105% तक बेहतर किया।
उद्योग और व्यवसाय
Stripe-OpenRouter सौदा. Stripe कथित तौर पर AI मॉडल रूटिंग स्टार्टअप OpenRouter को $7 बिलियन से अधिक में अधिग्रहित करेगा, इसके $1.3B सीरीज़ B के बाद; OpenRouter के 8 मिलियन उपयोगकर्ता और 250T टोकन/माह हैं।
Anthropic राजस्व वृद्धि. Anthropic की वार्षिक राजस्व रन दर जुलाई में $65B पार कर गई, जो मई में $47B और 2025 के अंत में $9B थी, इस पतझड़ में $2T+ मूल्यांकन पर IPO की उम्मीद है।
Relay बंद हो रहा है. AI वर्कफ़्लो स्वचालन स्टार्टअप Relay बंद हो रहा है; इसके संस्थापक और कुछ कर्मचारी Google की Chrome टीम में शामिल होकर Chrome में AI पर काम करेंगे।
Wispr ने $280M जुटाए. Wispr ने $2B मूल्यांकन पर $280M सीरीज़ B जुटाए, AI डिक्टेशन से नोट-लेने और मीटिंग्स में विस्तार करने के लिए, Canto मॉडल लॉन्च करते हुए।
AI वीडियो बाजार में सुधार. AI-जनित वीडियो Sora की झूठी शुरुआत के बाद हॉलीवुड स्टूडियो और अरबों को आकर्षित कर रहा है, जिसमें Promise जैसे स्टार्टअप वास्तविक समय की पृष्ठभूमि के लिए Seedance 2.5 का उपयोग कर रहे हैं।
Grab के AI एजेंट. Grab ने पांच-स्तरीय एजेंट स्वायत्तता मॉडल का उपयोग करके यांत्रिक विश्लेषण कार्य को 44% से घटाकर 30% कर दिया, विश्लेषकों के पास अंतिम निर्णय रखते हुए।
इंफ्रास्ट्रक्चर और कंप्यूट
OpenAI Ohio डेटा सेंटर. OpenAI ने SB Energy के साथ Ohio में PORTS-Pike पर 8 GW IT क्षमता के लिए 20 साल का पट्टा हस्ताक्षरित किया; Nvidia $105B तक का समर्थन करता है और एकमात्र चिप आपूर्तिकर्ता है।
Groq neocloud परिवर्तन. Groq ने $3.5B मूल्यांकन पर $350M जुटाए क्योंकि यह Nvidia के साथ लाइसेंसिंग सौदे के बाद AI चिप्स से Nvidia-आधारित neocloud इंफ्रास्ट्रक्चर संचालित करने की ओर स्थानांतरित हो रहा है।
RTX Pro 6000 मूल्य वृद्धि. CDW ने RTX Pro 6000 की MSRP $16k से बढ़ाकर $19,999 कर दी, और प्रयुक्त बाजार मूल्य भी बढ़ रहे हैं, जिससे स्थानीय AI निर्माताओं पर दबाव पड़ रहा है।
प्रशिक्षण डेटा और नीति
Amazon दुर्लभ पुस्तक स्कैनिंग. एक AirTag ने थोक दुर्लभ पुस्तक ऑर्डर को Amazon AI प्रशिक्षण सुविधा तक ट्रैक किया जहां कर्मचारी पुस्तकों को स्कैन करने के लिए नष्ट कर देते हैं; Amazon का कहना है कि वह व्यावसायिक चैनलों के माध्यम से पुस्तकें खरीदता है।
Anthropic Claude वॉटरमार्किंग. Anthropic EU AI अधिनियम का अनुपालन करने के लिए Claude आउटपुट में SynthID-Text वॉटरमार्क एम्बेड करेगा; आलोचक शब्द-पसंद की गुणवत्ता और पारदर्शिता की समस्याओं को लेकर चिंतित हैं।
आज के लिए बस इतना ही - लगभग 5 मिनट का पठन।