Agentic AI News आज

दिन के एआई एजेंट्स समाचार एक 5 मिनट की पढ़ाई में: रिलीज़, उपकरण, शोध, फंडिंग और उद्यम गतिविधियाँ।

प्रतिदिन अपडेट 30 स्रोतों से चुना गया रविवार, अगस्त 30, 2026

एजेंट और मॉडल रिलीज़

Tencent Hy4 प्रीव्यू. Tencent ने Hy4 प्रीव्यू जारी किया, जो Hy3 के मुकाबले आकार में बड़ा अपडेट है, जिसमें डिफ़ॉल्ट हाई रीज़निंग और no_think मोड है। कम्युनिटी के पास पहले से ~2.38-bit का आधिकारिक क्वांटाइज़्ड मॉडल और ~200GB का GGUF है, जो कथित तौर पर BF16 परफॉर्मेंस का लगभग 98% बनाए रखता है।

लोकल इन्फ़रेंस और हार्डवेयर

FlashMLA का sm_120 पोर्ट. कम्युनिटी बिल्ड FlashMLA को कंज़्यूमर Blackwell sm_120 GPU तक विस्तारित करता है, जो कई स्पार्स MLA वर्कलोड में PyTorch SDPA की तुलना में 2-3x स्पीडअप और FP8 KV कैश डिकोड के लिए 8% कम लेटेंसी दिखाता है।

Nemotron 16GB फिक्स. Nemotron-3.5-Lightning के लो-बिट GGUF फ़ाइलें रो-विड्थ क्वांटाइज़ेशन के कारण वास्तव में ~4.70 bpw की थीं; पैच किए गए llama.cpp बिल्ड से असली 3.07 bpw / 11.77 GiB फ़ाइल मिलती है, जो 16GB पर 262K कॉन्टेक्स्ट चलाती है।

Mac पर Qwen3.8-Flash-Next. 79GB का 2-bit Qwen3.8-Flash-Next, llama.cpp का उपयोग करके 128GB M5 Max पर 350K कॉन्टेक्स्ट स्लॉट के साथ चला, जिसमें 105K प्रॉम्प्ट का 333 सेकंड का कोल्ड प्रीफिल और ngram-mod स्पेक्युलेटिव डिकोडिंग शामिल हैं।

दो GPU पर DeepSeek V4 Flash. 2x DGX Spark/GX10 सेटअप पर DeepSeek V4 Flash 0731 लगातार 67-84 tok/s तक पहुंचता है, जिसमें स्थानीय HumanEval Pass@1 94.5% है, जबकि GLM-5.3-Flash NVFP4 के लिए 97.0% है। GLM ने बेंचमार्क लगभग आधे समय में पूरा किया।

दो 5090 पर 1M कॉन्टेक्स्ट. NInfer का एक फ़ोर्क टेंसर पैरेललिज़्म और YaRN ×4 स्केलिंग जोड़ता है, जिससे Qwen3.8-27B NVFP4 दो 5090 पर 10,48,576-टोकन कॉन्टेक्स्ट के साथ चलता है, 1M पर 48-100 tok/s की डिकोडिंग गति देता है और वहाँ MTP स्वीकृति बनाए रखता है जहाँ vLLM शून्य हो जाता है।

16GB पर 27B. हाइब्रिड क्वांटाइज़ेशन और kvarn कैश सेटिंग्स की मदद से Qwen3.8-27B 16GB RTX 4070 Ti SUPER पर 100K कॉन्टेक्स्ट के साथ 50 tok/s पर चलता है, जिसमें MTP स्पेक्युलेटिव डिकोडिंग और टेल-प्रिसिज़न KV कैश उपयोग होता है।

FreeToken MoE इंजन. UC Berkeley और MIT के शोधकर्ताओं ने FreeToken पेश किया, जो एक ओपन-सोर्स इंजन है और MoE एक्सपर्ट ट्रांसफ़र को गतिशील रूप से सह-शेड्यूल करता है, ताकि फ्रंटियर स्पार्स मॉडल PCIe/RAM मिस पर अटके बिना कंज़्यूमर GPU पर डिकोड कर सकें।

बेंचमार्क और मूल्यांकन

Terminal Bench 4.0. Terminal Bench 4.0 रिलीज़ हुआ है, जिसमें संतृप्ति से निपटने के लिए रिफ़्रेश लीडरबोर्ड और तेज़ इटरेशन पर फोकस किया गया है; GLM-5.3 का स्कोर त्रुटि सीमा के भीतर Fable 5 स्तर पर है।

फ़ाइनेंस बेंचमार्क खुलासा. Ling-3.0-flash-Fin के बेंचमार्क कार्ड से पता चलता है कि एजेंट स्कैफोल्डिंग, टूल्स और इवैलुएशन पाइपलाइन रिपोर्ट किए गए नतीजों को कितना प्रभावित करते हैं; कई रन में वेब सर्च और Python के साथ ReAct इस्तेमाल हुआ था, और कुछ इवैल सेट आंतरिक हैं या अभी सार्वजनिक नहीं हैं।

रिसर्च और एजेंट इंफ्रास्ट्रक्चर

Google WikiSkill मेमोरी. Google Research का WikiSkill एजेंट्स को पिछली असफलताओं और सफलताओं का स्थायी विकी-जैसा नॉलेज बेस देता है, और दोबारा इस्तेमाल योग्य Agent Skills को पैकेज करता है जो मॉडल वेट्स बदले बिना व्यवहार को दिशा देती हैं।

Anthropic Model Hardware Standard. Anthropic MHS बना रहा है, जो एजेंट्स को माइक्रोस्कोप और रोबोटिक आर्म्स जैसे भौतिक उपकरणों को नियंत्रित करने के लिए एक यूनिफाइड इंटरफ़ेस है; शुरुआती परीक्षणों में मल्टी-मशीन इंटीग्रेशन का समय हफ्तों से घटकर घंटों में आ गया, लेकिन इंसानी निगरानी अब भी ज़रूरी है।

एजेंट्स के लिए डेटा लेयर. TOTVS की एक प्रस्तुति में तर्क दिया गया है कि ट्रांज़ैक्शनल सिस्टम और डेटा लेक्स टोकन-भूखे, लेटेंसी-संवेदनशील एजेंट रीज़निंग के लिए अनुकूलित नहीं हैं, और डेटा एक्सेस को MCP और सिमेंटिक मॉडल की ओर विकसित करने का वर्णन किया गया है।

LAION Big Video Dataset. LAION ने BVD जारी किया, जो केवल रिसर्च के लिए डेटासेट है, जिसमें 10 मिलियन घंटे का वीडियो, 55 मिलियन क्लिप और 300 मिलियन स्टिल इमेज हैं, जो वीडियो, ऑडियो और टेक्स्ट को जोड़ता है; इस पर प्रशिक्षित मॉडलों ने कुछ बेंचमार्क में InternVid बेसलाइन से 2.1 अंकों तक बेहतर प्रदर्शन किया।

उद्योग और कारोबार

Sony और Warner ने Anthropic पर मुकदमा किया. Sony Music Publishing, Warner Chappell और अन्य प्रकाशकों ने Anthropic पर मुकदमा दायर किया है, जिसमें Claude को प्रशिक्षित करने के लिए कॉपीराइट कार्यों के टोरेंटिंग और स्क्रेपिंग का आरोप लगाया गया है, और प्रति कार्य $150,000 तक के हर्जाने की मांग की गई है। Anthropic का कहना है कि वह अपना बचाव करेगा।

OpenAI ने Cursor से नाता तोड़ा. OpenAI, SpaceX द्वारा Cursor के अधिग्रहण के बाद उसके साथ अपना अनुबंध समाप्त कर रहा है, और एलन मस्क की कंपनियों के अनुबंध तोड़ने के इतिहास का हवाला दे रहा है। Anthropic ने जवाब में खुद को अधिक विश्वसनीय साथी के रूप में पेश किया और Cursor के Claude उपयोग के लिए निरंतर कंप्यूट संसाधन देने का वादा किया।

GPU से आगे Nvidia. Nvidia की कमाई की कहानी अब GPU हिस्सेदारी से हटकर डेटासेंटर ऑर्केस्ट्रेशन और GPU के आसपास के सिस्टम पर केंद्रित हो रही है, जहाँ उसने अत्याधुनिक नेटवर्किंग और ऑर्केस्ट्रेशन हार्डवेयर बनाया है, क्योंकि AI कंप्यूट गीगावाट के स्तर तक पहुंच रहा है।

आज के लिए बस इतना ही - लगभग 5 मिनट का पठन।

इसे हर सुबह अपने ब्राउज़र में पढ़ें

एक्सटेंशन इस डाइजेस्ट को क्रोम के साइड पैनल में खोलता है — एक क्लिक, खाता नहीं।

क्रोम में जोड़ें — मुफ्त