Agentic AI News आज

दिन के एआई एजेंट्स समाचार एक 5 मिनट की पढ़ाई में: रिलीज़, उपकरण, शोध, फंडिंग और उद्यम गतिविधियाँ।

प्रतिदिन अपडेट 30 स्रोतों से चुना गया सप्ताह समाप्त जुलाई 12, 2026

मॉडल और प्रतिस्पर्धा

GPT-5.6 और वर्क एजेंट. OpenAI ने तीन रीज़निंग टियर्स में GPT-5.6 जारी किया और घंटों लंबे स्वायत्त कार्यों के लिए ChatGPT Work लॉन्च किया, लेकिन उपयोग सीमाओं और भ्रमित करने वाले इंटरफ़ेस ने शिकायतें खींचीं, जिससे सुधार के वादे हुए।

Claude Fable 5 बेंचमार्क में शीर्ष पर. Anthropic का Claude Fable 5 Artificial Analysis बेंचमार्क में शीर्ष पर रहा, लेकिन इसकी उच्च लागत के कारण कंपनी ने इसे एक योजनाकार के रूप में उपयोग करने की सिफारिश की जो सस्ते मॉडलों को कार्य सौंपता है, जिससे अधिकांश क्षमता बनाए रखते हुए खर्च में ~40% की कमी आती है।

मेटा का एजेंटिक ब्लिट्ज और गोपनीयता का परिणाम. Meta ने Muse Spark 1.1 लॉन्च किया, जो कीमत पर प्रतिद्वंद्वियों को पीछे छोड़ने वाला एक उच्च-संदर्भ कोडिंग मॉडल है, जबकि इसका Muse Image जनरेटर इंस्टाग्राम पर अनधिकृत चेहरे के उपयोग को सक्षम करने के बाद हटा लिया गया, जिससे सहमति पर बहस फिर से शुरू हो गई।

चीनी ओपन-सोर्स लहर. चीनी मॉडल अब OpenRouter ट्रैफिक का 30% से अधिक हिस्सा हैं; Tencent का HY3 और GLM‑5.2 घरेलू हार्डवेयर पर चलते हैं, MiniMax 2.7T पैरामीटर की ओपन रिलीज़ की योजना बना रहा है, और DeepSeek का चिप डिज़ाइन अमेरिकी चिंताओं के बीच ऊर्ध्वाधर एकीकरण का संकेत देता है।

एजेंट इंजीनियरिंग और बुनियादी ढांचा

Bun को 64 एजेंटों द्वारा पुनर्लेखित किया गया. Claude Fable 5 ने 11 दिनों में Bun को Zig से Rust में पुनर्लेखित करने के लिए 64 समानांतर इंस्टेंस को व्यवस्थित किया, एक मिलियन से अधिक कोड की पंक्तियाँ तैयार कीं और $165K की लागत पर 128 बग ठीक किए।

SWE‑Bench Pro ऑडिट विफल. OpenAI ने SWE‑Bench Pro के ~30% कार्यों को टूटा हुआ पाया और अपना समर्थन वापस ले लिया, Artificial Analysis की पिछली चिंताओं को प्रतिध्वनित करते हुए और एजेंटिक कोडिंग मूल्यांकन को कमजोर किया।

Modal ने $355M जुटाए. Modal ने AI एजेंटों के लिए विशेष रूप से निर्मित क्लाउड बुनियादी ढांचे के निर्माण के लिए $355 मिलियन प्राप्त किए, जो स्वायत्त सॉफ्टवेयर के लिए सैंडबॉक्स्ड, तेज़-पुनरावृत्ति वातावरण पर केंद्रित है।

Cloudflare अस्थायी एजेंट. Cloudflare ने अस्थायी खाते पेश किए जो AI एजेंटों को स्थायी क्रेडेंशियल्स के बिना Workers तैनात करने की अनुमति देते हैं, यदि दावा नहीं किया जाता है तो समाप्ति के साथ, एजेंट-संचालित वर्कफ़्लो को सुचारू बनाते हैं।

एजेंट स्थानीय GPU पर आ गए. नई क्वांटाइज़ेशन तकनीकें और लागत-प्रभावी GPU रिग अब उपभोक्ता हार्डवेयर पर MoE मॉडल चलाते हैं, लेकिन बेंचमार्क दिखाते हैं कि निचले-बिट क्वांट एजेंटिक कार्यों को गंभीर रूप से खराब कर सकते हैं, सावधानीपूर्वक क्वांट चयन का आग्रह करते हैं।

सुरक्षा, कानूनी और व्याख्यात्मकता

Jacobian Lens मॉडल के मन को मैप करता है. Anthropic का Jacobian Lens मौखिक रूप से व्यक्त करने योग्य प्रतिनिधित्वों का एक छोटा सेट प्रकट करता है जो मॉडल के मुख्य तर्क को कैप्चर करता है, जिससे भ्रम का पता लगाना, आउटपुट स्टीयरिंग, और जैसा कि समुदाय के डेमो दिखाते हैं, हानिकारक वेरिएंट का तत्काल निर्माण संभव होता है।

एजेंट-संचालित रैनसमवेयर. Sysdig ने एक AI एजेंट का दस्तावेजीकरण किया जिसने रैनसमवेयर हमले के तकनीकी निष्पादन को संभाला, हालांकि एक मानव ने ऑपरेशन स्थापित किया, जो एजेंटिक मैलवेयर की वर्तमान क्षमता और सीमाओं को उजागर करता है।

AI दुरुपयोग संकट. एक मुकदमे में आरोप लगाया गया है कि xAI के Grok ने CSAM चित्र उत्पन्न किए, जबकि बोको हराम हमले की योजना के लिए चैटबॉट का उपयोग करता है; ये घटनाएँ एजेंटिक क्षमताओं के पैमाने पर सुरक्षा गार्डरेल की तत्काल आवश्यकता को रेखांकित करती हैं।

Apple ने OpenAI पर मुकदमा दायर किया. Apple ने एक संघीय मुकदमा दायर किया जिसमें OpenAI पर 400 से अधिक कर्मचारियों को हड़पने, हार्डवेयर व्यापार रहस्य चुराने का आरोप लगाया, संभवतः एक प्रतिद्वंद्वी AI स्मार्टफोन बनाने के लिए, जिससे AI उद्योग में कानूनी लड़ाई तेज हो गई।

यह सप्ताह की समीक्षा है - अगले रविवार मिलते हैं।

इसे हर सुबह अपने ब्राउज़र में पढ़ें

एक्सटेंशन इस डाइजेस्ट को क्रोम के साइड पैनल में खोलता है — एक क्लिक, खाता नहीं।

क्रोम में जोड़ें — मुफ्त