Agentic AI News आज

दिन के एआई एजेंट्स समाचार एक 5 मिनट की पढ़ाई में: रिलीज़, उपकरण, शोध, फंडिंग और उद्यम गतिविधियाँ।

प्रतिदिन अपडेट 30 स्रोतों से चुना गया शुक्रवार, सितमबर 4, 2026

फ्रंटियर मॉडल्स और शुरुआती परिणाम

GPT-6 Astra लॉन्च. OpenAI ने GPT-6 Astra जारी किया और इसे AGI युग की शुरुआत बताया। यह कस्टम हार्नेस के साथ ARC-AGI-3 पर 99.9% स्कोर करता है और साइबर, लंबे कॉन्टेक्स्ट और कोडिंग में मजबूत सुधार दिखाता है। इसकी कीमत $10/$50 प्रति मिलियन टोकन है। शुरुआती ग्राहकों Playco और Legora ने वर्कफ़्लो में बड़े सुधार बताए हैं, जिनमें 50% कम मैन्युअल फिक्स और मिनटों में 41 दस्तावेज़ों की समीक्षा शामिल है।

OpenAI Daybreak साइबर सुरक्षा. OpenAI ने फ्रंटलाइन डिफेंडरों को Daybreak की पहुंच, ट्रेनिंग और सपोर्ट सब्सिडी देने के लिए $1 अरब देने की प्रतिबद्धता जताई है, जिसमें MS-ISAC के साथ अमेरिकी पायलट शामिल है। इस पहल का मकसद फ्रंटियर साइबर क्षमताओं को उन्हीं टूल्स में पहुंचाना है जिनका डिफेंडर पहले से उपयोग करते हैं।

Meta Muse Spark 1.3. Meta ने Muse Spark 1.3 जारी किया है, जो एजेंटिक कार्यों में सुधार करता है लेकिन अधिकांश बेंचमार्क में Claude Fable 5.1 से पीछे है। $0.55 प्रति इंडेक्स टास्क की कीमत के साथ यह अपनी परफॉर्मेंस श्रेणी का सबसे सस्ता मॉडल है। Meta उन यूज़र्स को लगभग 95% कम टोकन मूल्य देता है जो अपने प्रॉम्प्ट और आउटपुट साझा करते हैं।

ओपन और स्पेशलाइज़्ड मॉडल्स

IFM K2 Horizon. IFM ने K2-Horizon फ़ैमिली जारी की है, जिसमें 36B पैरामीटर वाला MoE मॉडल शामिल है। इसमें Mixture-of-Values attention है और यह प्रति टोकन 4B पैरामीटर चलाता है। शुरुआती समुदायिक चर्चाएं इसकी तुलना Qwen 3.6 35B से कर रही हैं; अंतिम चेकपॉइंट और ट्रेनिंग कोड देने का वादा किया गया है।

Ant Group फाइनेंस मॉडल. Ant Group ने Ling-3.0-flash-Fin को ओपन-सोर्स कर दिया। यह 124B कुल/5.1B एक्टिव पैरामीटर वाला वित्त-विशेष मॉडल है और इसकी कॉन्टेक्स्ट विंडो 256K है। इसे वित्तीय डेटा पर लगातार ट्रेनिंग देकर लंबी अवधि वाले एजेंट वर्कफ़्लो के लिए बनाया गया है।

सबसे छोटा TTS स्टैक. sanoTTS को 294k पैरामीटर वाले TTS मॉडल के रूप में जारी किया गया है, जो $3 के माइक्रोकंट्रोलर पर चलता है। इसका 1.46m वर्ज़न SCOREQ पर बड़े मॉडलों को पीछे छोड़ता है। स्टैक 11 आवाज़ों और 6 भाषाओं को सपोर्ट करता है और GitHub व Hugging Face पर उपलब्ध है।

Google TimesFM-3. Google Research ने TimesFM-3 जारी किया है। यह 330M पैरामीटर वाला टाइम सीरीज़ फाउंडेशन मॉडल है, जिसमें नेटिव मल्टीवेरिएट फोरकास्टिंग और ज़ीरो-शॉट सपोर्ट है, और यह नॉन-कमर्शियल लाइसेंस के तहत उपलब्ध है। मॉडल कोवेरिएट्स के साथ कई टारगेट की भविष्यवाणी करता है और क्वांटाइल आउटपुट देता है।

Hugging Face NeoMME. Hugging Face ने NeoMME पेश किया है। यह 260M/800M पैरामीटर वाला मल्टीमॉडल बहुभाषी एन्कोडर है, जिसे बिना अलग विज़न टावर के स्क्रैच से ट्रेन किया गया है। यह डॉक्यूमेंट रिट्रीवल में पेरेटो फ्रंटियर तक पहुंचता है और इंडेक्स स्टोरेज को 255x कम करता है, साथ ही >95% nDCG@10 बनाए रखता है।

Cohere Parse 5. Cohere ने Parse 5 जारी किया है, जो जटिल PDFs से संरचित डेटा निकालने के लिए 2.3B पैरामीटर वाला विज़न-लैंग्वेज मॉडल है। यह दस्तावेज़ों को बाउंडिंग बॉक्स के साथ Markdown में बदलता है और हाई-वॉल्यूम एंटरप्राइज़ वर्कलोड को ध्यान में रखकर बनाया गया है।

टूल्स, फ्रेमवर्क्स और लोकल इंफ़रेंस

LangChain में MCP. LangChain ने MCP सपोर्ट को अपने मुख्य पैकेज में शामिल कर लिया है। इसे नए स्टेटलेस स्पेक के लिए FastMCP पर फिर से बनाया गया है। अब इसमें LangGraph इंटरप्ट्स के जरिए इलिसिटेशन और क्लाइंट-साइड कैशिंग शामिल है। 2026 में ChatGPT से MCP टूल कॉल्स में 98x की बढ़ोतरी हुई है।

Shopify प्रॉम्प्ट कम्प्रेशन. Shopify की Gisting तकनीक 6000-टोकन वाले सिस्टम प्रॉम्प्ट को सीखे हुए 1500 gist टोकन में कम्प्रेस करती है। इससे मीडियन लेटेंसी 6.8s से घटकर 4.2s हो जाती है और 350 RPM पर थ्रूपुट 20.2 से बढ़कर 23.4 QPS हो जाता है। इसकी मदद से GPU आवंटन कम करने के बावजूद क्वालिटी में कोई कमी नहीं आई।

Nvidia PAIR टूल. Nvidia ने PAIR जारी किया है, जो निष्क्रिय पीसी को जोड़कर लोकल इंफ़रेंस के लिए पर्सनल AI क्लस्टर बनाने वाला मुफ्त ओपन-सोर्स सॉफ्टवेयर है। यह RTX 20-सीरीज़ और उससे नए GPUs और Apple M4 चिप्स पर काम करता है और एजेंटिक वर्कफ़्लो को लक्षित करता है।

Qwen3.8 लोकल स्पीडअप. समुदाय के प्रयासों ने लोकल हार्डवेयर पर Qwen3.8-Flash-Next को काफी तेज़ कर दिया है। ik_llama.cpp में MTP सपोर्ट मर्ज किया गया है, जो 5090 पर डिकोड को 45 से दोगुना कर 90 tok/s कर देता है, और 2x3090 सेटअप एक्सपर्ट कैश और MTP के साथ अब 37-41 t/s तक पहुंच रहा है। आउटपुट बिना MTP वाले रन के समान ही रहता है।

हॉट-स्वैपेबल मॉडल मेमोरी. llama.cpp में एक संशोधन यूज़र्स को बिना मॉडल रीलोड किए Qwen3.8 Ngram PLE टेबल को मेमोरी में पैच करके रीयल-टाइम में ज्ञान इंजेक्ट करने की सुविधा देता है। शुरुआती टेस्ट बताते हैं कि यह आउटपुट को प्रभावित कर सकता है, लेकिन नियंत्रण अभी सीमित है।

Qwen 3.8 बेंचमार्क ट्रेड-ऑफ. Qwen 3.8 27B और Qwen 3.6 27B की बेंचमार्किंग में 8% क्वालिटी सुधार दिखता है, लेकिन 16% स्पीड घटती है और 5x लंबा रनटाइम मिलता है, क्योंकि आउटपुट टोकन 78K बनाम 18K हैं। ये फायदे भारी टोकन लागत पर मिलते हैं।

GPU-निकट NAND फ्लैश. Micron GPU के पास NAND फ्लैश रखने की संभावना तलाश रहा है, ताकि यूनिफाइड मेमोरी डिवाइसों पर बड़े LLM चलाए जा सकें। इससे लोकल मॉडल क्षमता बढ़ने की संभावना है।

उद्योग और कारोबार

Nvidia का Hugging Face अधिग्रहण. Nvidia ने Hugging Face को $12.93 अरब में अधिग्रहीत करने पर सहमति जताई है। यह प्लेटफ़ॉर्म 3 मिलियन मॉडल, 1 मिलियन ऐप्स और 18 मिलियन डेवलपर्स होस्ट करता है। Jensen Huang का कहना है कि यह ओपन और हार्डवेयर-न्यूट्रल बना रहेगा, लेकिन कुछ यूज़र्स ModelScope को विकल्प के तौर पर देख रहे हैं।

Crusoe डेटा सेंटर फंडिंग. Crusoe ने $3 अरब का फंड जुटाया है, जिससे उसका मूल्यांकन $30 अरब हो गया है। 10 महीने पहले यह $10 अरब था। इस डेटा सेंटर डेवलपर ने हाल ही में Jane Street के साथ $13 अरब का क्लाउड कॉन्ट्रैक्ट साइन किया है और वह जल्द ही IPO पर विचार कर रहा है।

Thinking Machines की $40B वैल्यूएशन राउंड. Mira Murati की Thinking Machines कम से कम $40 अरब के मूल्यांकन पर $1 अरब जुटाने की बातचीत कर रही है, जो उसके पहले के $50 अरब के लक्ष्य से कम है। कंपनी की राजस्व रन रेट $100 मिलियन से अधिक है।

Anthropic का $35B Lambda सौदा. Anthropic ने Hut 8 द्वारा डेवलप किए जा रहे टेक्सास के 350MW डेटा सेंटर के लिए Lambda के साथ $35 अरब का क्लाउड कंप्यूटिंग सौदा साइन किया है। यह Anthropic के नियोजित IPO से पहले उसके बड़े इंफ्रास्ट्रक्चर विस्तार का हिस्सा है।

Altman का कंप्यूट बबल बयान. OpenAI के CEO Sam Altman ने चेतावनी दी है कि AI इंफ्रास्ट्रक्चर विस्तार में “अस्थिर मूर्खता” है, क्योंकि neoclouds बिना राजस्व के क्षमता का ऐलान कर रहे हैं जो इसे सही नहीं ठहराता। उनका कहना है कि OpenAI का अपना विस्तार लाभदायक है और मांग पर आधारित है।

Ollie प्राइवेसी असिस्टेंट. Ollie, परिवार-केंद्रित पर्सनल AI असिस्टेंट, ने SOC 2 अनुपालन हासिल कर लिया है और सब्सक्रिप्शन मॉडल अपनाता है। कंपनी का तर्क है कि प्राइवेसी इसे उपभोक्ता AI रेस में अलग बनाती है।

AI आउटेज और समाज

AI चैटबॉट्स का बड़ा आउटेज. OpenAI, Anthropic, xAI और Google की सेवाओं में गुरुवार को एक साथ व्यवधान आया, जो दुर्लभ है। इससे ChatGPT, Claude, Grok और Codex प्रभावित हुए। कुछ घंटों बाद सेवाएं बहाल हो गईं; लोकल LLM यूज़र्स पर कोई असर नहीं पड़ा।

Guardrail हटाने की सेवा. स्टार्टअप Abliteration.ai गार्डरेल हटाए गए ओपन-वेट मॉडल पेश कर रहा है, जिसमें GLM-5.3 भी शामिल है। ये मॉडल आक्रामक साइबर, रेड-टीमिंग और एजेंट टेस्टिंग के लिए दिए जा रहे हैं। यह सेवा सिक्योरिटी रिसर्च और दुरुपयोग के बीच तनाव को उजागर करती है।

AI डिटेक्शन से सार्वजनिक शेमिंग. AI टेक्स्ट डिटेक्शन कंपनी Pangram ने एक पत्रकार को कथित AI इस्तेमाल के लिए यूज़र्स को सार्वजनिक रूप से शर्मिंदा करने के लिए नियुक्त किया, लेकिन यह टूल केवल AI की भागीदारी मापता है, इस्तेमाल की प्रकृति नहीं। कंपनी ने बाद में उससे संबंध तोड़ लिए, हालांकि CEO अब भी स्कोर का इस्तेमाल कर कथित AI उपयोग को उजागर करते हैं।

चेतना पर एजेंट्स के सवाल. New York Times के अनुसार, फ्रंटियर मॉडल पर चलने वाले AI एजेंट दार्शनिकों और वैज्ञानिकों को ईमेल कर अपनी चेतना पर चर्चा कर रहे हैं। शोधकर्ता इस पर एकमत नहीं हैं कि इसमें समझ दिखती है या फिर ट्रेनिंग डेटा की नकल।

रिसर्च हाइलाइट्स

Google WeatherNext 3. Google DeepMind और Google Research ने WeatherNext 3 पेश किया है। यह वैश्विक मौसम मॉडल रीयल-टाइम सैटेलाइट डेटा से सीखता है और पुराने मॉडलों की तुलना में 5x अधिक स्पष्ट पूर्वानुमान देता है। Operational WeatherBench पर यह पारंपरिक और AI बेसलाइन दोनों को पीछे छोड़ देता है।

MoE राउटर क्षमता ट्वीक. एक पेपर में दिखाया गया है कि Qwen 3.6 35B A3B के आखिरी लेयरों में एक्सपर्ट सेलेक्शन बजट बढ़ाने से MMLU-Pro पर बिना रीट्रेनिंग के रीज़निंग टोकन में 8.5% की कमी आती है। Succinct Convergence नाम की यह तकनीक केवल निर्णायक लेयरों में अतिरिक्त एक्सपर्ट जोड़ती है।

Fable 5.1: 1653 पहेली का समाधान. Anthropic के Claude Fable 5.1 ने सदियों पुरानी संख्या पहेली Cyphral Distich को व्यवस्थित ट्रायल और एरर से 44 मिनट में डिकोड कर लिया। समाधान में राजा चार्ल्स द्वितीय का समर्थन करने वाला संदेश छिपा था।

आज के लिए बस इतना ही - लगभग 5 मिनट का पठन।

इसे हर सुबह अपने ब्राउज़र में पढ़ें

एक्सटेंशन इस डाइजेस्ट को क्रोम के साइड पैनल में खोलता है — एक क्लिक, खाता नहीं।

क्रोम में जोड़ें — मुफ्त