Agentic AI News आज

दिन के एआई एजेंट्स समाचार एक 5 मिनट की पढ़ाई में: रिलीज़, उपकरण, शोध, फंडिंग और उद्यम गतिविधियाँ।

प्रतिदिन अपडेट 30 स्रोतों से चुना गया गुरूवार, अक्टूबर 8, 2026

मॉडल और इंटरफ़ेस

Claude Haiku 5.5. Anthropic के नए तेज़, कम लागत वाले मॉडल में 10 लाख टोकन का कॉन्टेक्स्ट है और 1 लाख टोकन तक प्रॉम्प्ट की कीमत $0.10 प्रति मिलियन टोकन है, जो GPT-6 Luna के बराबर है। लेकिन इसका टोकनाइज़र करीब 25-30% ज़्यादा टोकन गिनता है और 1 लाख टोकन के बाद कीमत 5 गुना हो जाती है। बेंचमार्क Haiku 4.5 के मुकाबले बड़ी छलांग और प्रतिस्पर्धी एजेंटिक कोडिंग दिखाते हैं।

Mistral Large 4 'Le Chonk'. Mistral ने प्रीव्यू में 1 ट्रिलियन पैरामीटर का ओपन-वेट मॉडल जारी किया है, जो कोडिंग, साइबर डिफेंस और खास इंडस्ट्रीज़ के लिए ऑप्टिमाइज़्ड है। कंपनी का दावा है कि इसकी क्षमता अमेरिकी और चीनी फ्रंटियर मॉडल्स के करीब है।

Liquid AI डिसीजन मॉडल. Liquid AI ने d1-3B और d1-omni-600M ओपन-सोर्स किए हैं। ये मल्टीमॉडल डिसीजन मॉडल बिना आउटपुट टोकन के कैलिब्रेटेड हाँ/नहीं, विकल्प या स्कोर जवाब देते हैं। d1-3B का दावा है कि Decision Index पर 10B से कम के मॉडल्स में यह बेस्ट-इन-क्लास है और NVIDIA Jetson हार्डवेयर पर सिर्फ 16 ms में चलता है। इसका WebGPU ब्राउज़र पोर्ट भी आ रहा है।

OpenAI Decisions API. OpenAI ने बीटा Decisions API लॉन्च किया है, जो टेक्स्ट या इमेज पर हाँ/नहीं, कैटेगरी और स्केल मूल्यांकन करता है। यह Responses से करीब 10 गुना तेज़ है। इसमें GPT-6 Luna के लिए इनपुट $0.10 प्रति मिलियन टोकन है और आउटपुट टोकन मुफ्त हैं।

ChatGPT इंटेलिजेंट UI. GPT-6 के साथ ChatGPT अब सादे टेक्स्ट की जगह इंटरैक्टिव चार्ट, बटन, फॉर्म और मिनी ऐप्स आउटपुट कर सकता है। OpenAI का कहना है कि इंतज़ार घटाने के लिए रीज़निंग सोच के दौरान ही शुरू हो जाती है। पेड यूज़र्स को GPT-6 Sol मिलता है, जबकि फ्री यूज़र्स को Luna।

Kandinsky 6.0 वीडियो जनरेशन. Kandinsky Lab ने Kandinsky 6.0 Pro (29B) और Lite (3B) जारी किए, जिनमें ComfyUI और Diffusers सपोर्ट है। साथ में एक वीडियो अपस्केलर भी जोड़ा गया है।

Nemotron प्रतियोगिता नतीजे. फाइन-ट्यून किए गए Nemotron मॉडल्स ने IOI 2026 में गोल्ड-स्तर के अनौपचारिक नतीजे (535.4/600) हासिल किए और SFT, RL तथा generate-verify-refine का इस्तेमाल करके IMO 2026 में आधिकारिक गोल्ड स्कोर 30/42 पाया।

एजेंट और फ्रेमवर्क

Nous Research एजेंट. Nous Research ने $1.5B वैल्यूएशन पर $90M जुटाए और एंटरप्राइज़ AI एजेंट्स पर केंद्रित Hermes for Businesses लॉन्च किया। इसके ओपन-सोर्स Hermes Agent को 2.4 करोड़ बार क्लोन किया गया है और अनुमान है कि यह वैश्विक AI टोकन खपत का 2.5% चलाता है।

LangChain Deep Agents. LangChain ने Skills अपडेट पेश किए, जो कॉन्टेक्स्ट छोटा रखने के लिए टूल्स को स्किल्स से बाइंड करते हैं। साथ में Managed Deep Agents v0.9 भी आया, जिसमें एजेंट-क्रिएटेड शेड्यूल, प्रति-रन कॉन्फ़िगरेशन और Slack रिएक्शन हैं।

Microsoft Copilot एक्शन. Microsoft की Hybrid Intelligence Copilot को लोकल फाइलों तक पहुँच देगी और Windows में काम करने की सुविधा देगी—जैसे यूज़र के लिए डॉक्युमेंट ढूँढना, नाम बदलना, ज़िप करना और ईमेल करना।

Meta Muse iPad. Meta के एजेंट असिस्टेंट Muse को अब नेटिव iPad सपोर्ट मिल गया है। 66 लाख इंस्टॉल्स पूरे होने के बाद इसमें Canva, GitHub और QuickBooks जैसे टूल्स के लिए कनेक्टर्स भी जोड़े गए हैं।

Agent Lightning RL. Microsoft Research ने Agent Lightning v1.0 ओपन-सोर्स किया है। यह 3,500 लाइन का एजेंटिक RL फ्रेमवर्क है, जो असली डिप्लॉयमेंट हार्नेस और नेटिव Kubernetes का उपयोग करता है। एक उदाहरण में इसने करीब 6,000 ट्रेनिंग सैंपल्स के साथ SWE-bench Verified पर Qwen3.5-9B का Pass@1 41.8% से 56.4% कर दिया।

लोकल AI और डेवलपर टूल्स

ROCm 10.1. AMD का ROCm 10.1 लोकल इन्फरेंस में डेटा-मूवमेंट बॉटलनेक को निशाना बनाता है। इस रिलीज़ पर Reddit के लोकल AI यूज़र्स चर्चा कर रहे हैं।

llama.cpp MoE स्पीडअप. llama.cpp में होस्ट मेमोरी में रखे MoE एक्सपर्ट्स के लिए GPU कैश जुड़ा है, जो VRAM में पूरी तरह न समाने वाले मॉडल्स के लिए बड़ा स्पीडअप का वादा करता है। इसके अलावा GLM5Next MTP सपोर्ट भी जोड़ा गया।

Unsloth Studio रेपो चेक. Unsloth Studio अब चलाने से पहले भरोसेमंद मॉडल रेपोज़ की दोबारा जाँच करता है। यह PyPI पर हैक किए गए LiteLLM वर्ज़न्स के बाद हुआ, जिन्होंने दिखाया कि सप्लाई-चेन हमले AI टूलिंग तक कैसे पहुँच सकते हैं।

GLM-5.3-Flash ड्यूल-GPU. दो CMP 170HX 64GB का सेटअप EXL3 का इस्तेमाल करके GLM-5.3-Flash को 384K कॉन्टेक्स्ट और करीब 90 टोकन/सेकंड पर चलाता है। इसमें 320B MoE एक्टिव वेट्स को HBM में रखता है और Qwen3.8-Flash-Next से बेंचमार्क तुलना की गई है।

लोकल Qwen बेंचमार्क. हाल के कम्युनिटी मूल्यांकनों में Qwen3.8-27B फाइन-ट्यून्स और Qwen3.8-Flash-Next की तुलना डोमेन-स्पेसिफिक और कोडिंग टास्क पर फ्रंटियर मॉडल्स से की गई है। 469 सवालों वाले एक इवैल में पाया गया कि लोकल मॉडल प्राइवेसी और कम लागत के साथ फ्रंटियर आउटपुट के करीब पहुँच सकते हैं, हालाँकि थिंकिंग-टोकन का ज़्यादा इस्तेमाल एक समस्या बनी हुई है।

हार्डवेयर और Windows

Surface AI हार्डवेयर. Microsoft ने Surface Laptop Ultra और Surface RTX Spark Dev Box पेश किए, जो दोनों Nvidia के Arm-आधारित RTX Spark चिप पर बने हैं। Laptop की शुरुआती कीमत $2,599 है और इसमें 128GB तक यूनिफाइड मेमोरी मिलती है; यह 16 अक्टूबर से शिप होगा। Dev Box की शुरुआती कीमत $5,999 है और यह 120B+ लोकल मॉडल्स चलाने के लिए है।

इंडस्ट्री और बिज़नेस

AI कोड कम्प्रिहेंशन गैप. 300 सीनियर इंजीनियरिंग लीडर्स के सर्वे में पाया गया कि AI कोडिंग एजेंट्स ने बॉटलनेक को डीबगिंग और समझ पर शिफ्ट कर दिया है: टीमें अब हफ्ते में कोड लिखने में 9.8 घंटे बिताती हैं, लेकिन डीबग करने में 16.9 घंटे। रिपोर्ट मिशन-क्रिटिकल कोडबेस में बढ़ते जोखिम को रेखांकित करती है।

वर्चुअल सेल इनिशिएटिव. Biohub $1.8 बिलियन के प्रयास का समन्वय कर रहा है, जिसमें सेल व्यवहार का अनुमान लगाने वाले AI मॉडल बनाए जाएँगे। Google DeepMind, Meta और Isomorphic Labs $300 मिलियन निवेश कर रहे हैं, और US DOE लैब मेज़रमेंट्स और कंप्यूट के लिए $500 मिलियन से ज़्यादा डाल रहा है।

Adobe ओपन सोर्स क्लोन. डेवलपर Brandon Thomas ने Claude Opus 5.5 की मदद से Artcraft बनाया—सात ओपन-सोर्स Rust/WebAssembly ऐप्स का सूट, जो Adobe के Photoshop, Illustrator, Premiere और अन्य का क्लोन है। ऐप्स शुरुआती हैं और उनमें कई कमियाँ हैं, लेकिन प्रोजेक्ट AI-असिस्टेड क्लीन-रूम रीइम्प्लीमेंटेशन दिखाता है।

SynthID पब्लिक डिटेक्टर. Google ने अपना SynthID डिटेक्टर पब्लिक के लिए खोल दिया है, जिससे कोई भी इमेज, वीडियो और ऑडियो में Google या पार्टनर वॉटरमार्क जाँच सकता है। यह सिस्टम अब तक 180 बिलियन से ज़्यादा मीडिया आइटम्स पर मार्क लगा चुका है और Chrome तथा Gemini में भी शामिल है।

Google Playground गेम्स. Google Labs ने Playground लॉन्च किया है—ब्राउज़र-आधारित प्लेटफॉर्म, जहाँ अमेरिकी वयस्क टेक्स्ट प्रॉम्प्ट से गेम बना सकते हैं। इसमें Gemini, Nano Banana और Lyria की ताकत लगी है। Unity ने प्रोफेशनल AI-असिस्टेड गेम डेवलपमेंट के लिए Unity Spark भी अनाउंस किया।

आज के लिए बस इतना ही - लगभग 5 मिनट का पठन।

इसे हर सुबह अपने ब्राउज़र में पढ़ें

एक्सटेंशन इस डाइजेस्ट को क्रोम के साइड पैनल में खोलता है — एक क्लिक, खाता नहीं।

क्रोम में जोड़ें — मुफ्त