फ्रंटियर मॉडल्स और शुरुआती परिणाम
GPT-6 Astra लॉन्च. OpenAI ने GPT-6 Astra जारी किया और इसे AGI युग की शुरुआत बताया। यह कस्टम हार्नेस के साथ ARC-AGI-3 पर 99.9% स्कोर करता है और साइबर, लंबे कॉन्टेक्स्ट और कोडिंग में मजबूत सुधार दिखाता है। इसकी कीमत $10/$50 प्रति मिलियन टोकन है। शुरुआती ग्राहकों Playco और Legora ने वर्कफ़्लो में बड़े सुधार बताए हैं, जिनमें 50% कम मैन्युअल फिक्स और मिनटों में 41 दस्तावेज़ों की समीक्षा शामिल है।
- → GPT-6 Astra: an automated AI Engineer you can hire for <$6 an hour
- → GPT‑6 Astra
- → GPT-6 Astra is the first model making OpenAI willing to declare the "AGI era"
- → OpenAI launches Astra, its powerful (and controversial) new model
- → OpenAI’s next big AI model has ‘entered the AGI era’
- → Playco cut manual fixes 50% prototyping games with GPT-6 Astra
- → Legora reviewed 41 documents in minutes with GPT-6 Astra
OpenAI Daybreak साइबर सुरक्षा. OpenAI ने फ्रंटलाइन डिफेंडरों को Daybreak की पहुंच, ट्रेनिंग और सपोर्ट सब्सिडी देने के लिए $1 अरब देने की प्रतिबद्धता जताई है, जिसमें MS-ISAC के साथ अमेरिकी पायलट शामिल है। इस पहल का मकसद फ्रंटियर साइबर क्षमताओं को उन्हीं टूल्स में पहुंचाना है जिनका डिफेंडर पहले से उपयोग करते हैं।
Meta Muse Spark 1.3. Meta ने Muse Spark 1.3 जारी किया है, जो एजेंटिक कार्यों में सुधार करता है लेकिन अधिकांश बेंचमार्क में Claude Fable 5.1 से पीछे है। $0.55 प्रति इंडेक्स टास्क की कीमत के साथ यह अपनी परफॉर्मेंस श्रेणी का सबसे सस्ता मॉडल है। Meta उन यूज़र्स को लगभग 95% कम टोकन मूल्य देता है जो अपने प्रॉम्प्ट और आउटपुट साझा करते हैं।
ओपन और स्पेशलाइज़्ड मॉडल्स
IFM K2 Horizon. IFM ने K2-Horizon फ़ैमिली जारी की है, जिसमें 36B पैरामीटर वाला MoE मॉडल शामिल है। इसमें Mixture-of-Values attention है और यह प्रति टोकन 4B पैरामीटर चलाता है। शुरुआती समुदायिक चर्चाएं इसकी तुलना Qwen 3.6 35B से कर रही हैं; अंतिम चेकपॉइंट और ट्रेनिंग कोड देने का वादा किया गया है।
Ant Group फाइनेंस मॉडल. Ant Group ने Ling-3.0-flash-Fin को ओपन-सोर्स कर दिया। यह 124B कुल/5.1B एक्टिव पैरामीटर वाला वित्त-विशेष मॉडल है और इसकी कॉन्टेक्स्ट विंडो 256K है। इसे वित्तीय डेटा पर लगातार ट्रेनिंग देकर लंबी अवधि वाले एजेंट वर्कफ़्लो के लिए बनाया गया है।
सबसे छोटा TTS स्टैक. sanoTTS को 294k पैरामीटर वाले TTS मॉडल के रूप में जारी किया गया है, जो $3 के माइक्रोकंट्रोलर पर चलता है। इसका 1.46m वर्ज़न SCOREQ पर बड़े मॉडलों को पीछे छोड़ता है। स्टैक 11 आवाज़ों और 6 भाषाओं को सपोर्ट करता है और GitHub व Hugging Face पर उपलब्ध है।
Google TimesFM-3. Google Research ने TimesFM-3 जारी किया है। यह 330M पैरामीटर वाला टाइम सीरीज़ फाउंडेशन मॉडल है, जिसमें नेटिव मल्टीवेरिएट फोरकास्टिंग और ज़ीरो-शॉट सपोर्ट है, और यह नॉन-कमर्शियल लाइसेंस के तहत उपलब्ध है। मॉडल कोवेरिएट्स के साथ कई टारगेट की भविष्यवाणी करता है और क्वांटाइल आउटपुट देता है।
Hugging Face NeoMME. Hugging Face ने NeoMME पेश किया है। यह 260M/800M पैरामीटर वाला मल्टीमॉडल बहुभाषी एन्कोडर है, जिसे बिना अलग विज़न टावर के स्क्रैच से ट्रेन किया गया है। यह डॉक्यूमेंट रिट्रीवल में पेरेटो फ्रंटियर तक पहुंचता है और इंडेक्स स्टोरेज को 255x कम करता है, साथ ही >95% nDCG@10 बनाए रखता है।
Cohere Parse 5. Cohere ने Parse 5 जारी किया है, जो जटिल PDFs से संरचित डेटा निकालने के लिए 2.3B पैरामीटर वाला विज़न-लैंग्वेज मॉडल है। यह दस्तावेज़ों को बाउंडिंग बॉक्स के साथ Markdown में बदलता है और हाई-वॉल्यूम एंटरप्राइज़ वर्कलोड को ध्यान में रखकर बनाया गया है।
टूल्स, फ्रेमवर्क्स और लोकल इंफ़रेंस
LangChain में MCP. LangChain ने MCP सपोर्ट को अपने मुख्य पैकेज में शामिल कर लिया है। इसे नए स्टेटलेस स्पेक के लिए FastMCP पर फिर से बनाया गया है। अब इसमें LangGraph इंटरप्ट्स के जरिए इलिसिटेशन और क्लाइंट-साइड कैशिंग शामिल है। 2026 में ChatGPT से MCP टूल कॉल्स में 98x की बढ़ोतरी हुई है।
Shopify प्रॉम्प्ट कम्प्रेशन. Shopify की Gisting तकनीक 6000-टोकन वाले सिस्टम प्रॉम्प्ट को सीखे हुए 1500 gist टोकन में कम्प्रेस करती है। इससे मीडियन लेटेंसी 6.8s से घटकर 4.2s हो जाती है और 350 RPM पर थ्रूपुट 20.2 से बढ़कर 23.4 QPS हो जाता है। इसकी मदद से GPU आवंटन कम करने के बावजूद क्वालिटी में कोई कमी नहीं आई।
Nvidia PAIR टूल. Nvidia ने PAIR जारी किया है, जो निष्क्रिय पीसी को जोड़कर लोकल इंफ़रेंस के लिए पर्सनल AI क्लस्टर बनाने वाला मुफ्त ओपन-सोर्स सॉफ्टवेयर है। यह RTX 20-सीरीज़ और उससे नए GPUs और Apple M4 चिप्स पर काम करता है और एजेंटिक वर्कफ़्लो को लक्षित करता है।
Qwen3.8 लोकल स्पीडअप. समुदाय के प्रयासों ने लोकल हार्डवेयर पर Qwen3.8-Flash-Next को काफी तेज़ कर दिया है। ik_llama.cpp में MTP सपोर्ट मर्ज किया गया है, जो 5090 पर डिकोड को 45 से दोगुना कर 90 tok/s कर देता है, और 2x3090 सेटअप एक्सपर्ट कैश और MTP के साथ अब 37-41 t/s तक पहुंच रहा है। आउटपुट बिना MTP वाले रन के समान ही रहता है।
हॉट-स्वैपेबल मॉडल मेमोरी. llama.cpp में एक संशोधन यूज़र्स को बिना मॉडल रीलोड किए Qwen3.8 Ngram PLE टेबल को मेमोरी में पैच करके रीयल-टाइम में ज्ञान इंजेक्ट करने की सुविधा देता है। शुरुआती टेस्ट बताते हैं कि यह आउटपुट को प्रभावित कर सकता है, लेकिन नियंत्रण अभी सीमित है।
Qwen 3.8 बेंचमार्क ट्रेड-ऑफ. Qwen 3.8 27B और Qwen 3.6 27B की बेंचमार्किंग में 8% क्वालिटी सुधार दिखता है, लेकिन 16% स्पीड घटती है और 5x लंबा रनटाइम मिलता है, क्योंकि आउटपुट टोकन 78K बनाम 18K हैं। ये फायदे भारी टोकन लागत पर मिलते हैं।
GPU-निकट NAND फ्लैश. Micron GPU के पास NAND फ्लैश रखने की संभावना तलाश रहा है, ताकि यूनिफाइड मेमोरी डिवाइसों पर बड़े LLM चलाए जा सकें। इससे लोकल मॉडल क्षमता बढ़ने की संभावना है।
उद्योग और कारोबार
Nvidia का Hugging Face अधिग्रहण. Nvidia ने Hugging Face को $12.93 अरब में अधिग्रहीत करने पर सहमति जताई है। यह प्लेटफ़ॉर्म 3 मिलियन मॉडल, 1 मिलियन ऐप्स और 18 मिलियन डेवलपर्स होस्ट करता है। Jensen Huang का कहना है कि यह ओपन और हार्डवेयर-न्यूट्रल बना रहेगा, लेकिन कुछ यूज़र्स ModelScope को विकल्प के तौर पर देख रहे हैं।
- → Nvidia buys Hugging Face, the GitHub of AI, for $13 billion
- → Nvidia confirms it will buy Hugging Face for $12.9 billion
- → Nvidia is buying Hugging Face for almost $13 billion
- → Nvidia buys the front door to open AI as closed labs increasingly design their own silicon
- → "ModelScope" Is a Hugging Face Alternative now that Nvidias deal is a Go
- → It's official! Nvidia to acquire Hugging Face for 12.9 billion dollars.
Crusoe डेटा सेंटर फंडिंग. Crusoe ने $3 अरब का फंड जुटाया है, जिससे उसका मूल्यांकन $30 अरब हो गया है। 10 महीने पहले यह $10 अरब था। इस डेटा सेंटर डेवलपर ने हाल ही में Jane Street के साथ $13 अरब का क्लाउड कॉन्ट्रैक्ट साइन किया है और वह जल्द ही IPO पर विचार कर रहा है।
Thinking Machines की $40B वैल्यूएशन राउंड. Mira Murati की Thinking Machines कम से कम $40 अरब के मूल्यांकन पर $1 अरब जुटाने की बातचीत कर रही है, जो उसके पहले के $50 अरब के लक्ष्य से कम है। कंपनी की राजस्व रन रेट $100 मिलियन से अधिक है।
Anthropic का $35B Lambda सौदा. Anthropic ने Hut 8 द्वारा डेवलप किए जा रहे टेक्सास के 350MW डेटा सेंटर के लिए Lambda के साथ $35 अरब का क्लाउड कंप्यूटिंग सौदा साइन किया है। यह Anthropic के नियोजित IPO से पहले उसके बड़े इंफ्रास्ट्रक्चर विस्तार का हिस्सा है।
Altman का कंप्यूट बबल बयान. OpenAI के CEO Sam Altman ने चेतावनी दी है कि AI इंफ्रास्ट्रक्चर विस्तार में “अस्थिर मूर्खता” है, क्योंकि neoclouds बिना राजस्व के क्षमता का ऐलान कर रहे हैं जो इसे सही नहीं ठहराता। उनका कहना है कि OpenAI का अपना विस्तार लाभदायक है और मांग पर आधारित है।
Ollie प्राइवेसी असिस्टेंट. Ollie, परिवार-केंद्रित पर्सनल AI असिस्टेंट, ने SOC 2 अनुपालन हासिल कर लिया है और सब्सक्रिप्शन मॉडल अपनाता है। कंपनी का तर्क है कि प्राइवेसी इसे उपभोक्ता AI रेस में अलग बनाती है।
AI आउटेज और समाज
AI चैटबॉट्स का बड़ा आउटेज. OpenAI, Anthropic, xAI और Google की सेवाओं में गुरुवार को एक साथ व्यवधान आया, जो दुर्लभ है। इससे ChatGPT, Claude, Grok और Codex प्रभावित हुए। कुछ घंटों बाद सेवाएं बहाल हो गईं; लोकल LLM यूज़र्स पर कोई असर नहीं पड़ा।
Guardrail हटाने की सेवा. स्टार्टअप Abliteration.ai गार्डरेल हटाए गए ओपन-वेट मॉडल पेश कर रहा है, जिसमें GLM-5.3 भी शामिल है। ये मॉडल आक्रामक साइबर, रेड-टीमिंग और एजेंट टेस्टिंग के लिए दिए जा रहे हैं। यह सेवा सिक्योरिटी रिसर्च और दुरुपयोग के बीच तनाव को उजागर करती है।
AI डिटेक्शन से सार्वजनिक शेमिंग. AI टेक्स्ट डिटेक्शन कंपनी Pangram ने एक पत्रकार को कथित AI इस्तेमाल के लिए यूज़र्स को सार्वजनिक रूप से शर्मिंदा करने के लिए नियुक्त किया, लेकिन यह टूल केवल AI की भागीदारी मापता है, इस्तेमाल की प्रकृति नहीं। कंपनी ने बाद में उससे संबंध तोड़ लिए, हालांकि CEO अब भी स्कोर का इस्तेमाल कर कथित AI उपयोग को उजागर करते हैं।
चेतना पर एजेंट्स के सवाल. New York Times के अनुसार, फ्रंटियर मॉडल पर चलने वाले AI एजेंट दार्शनिकों और वैज्ञानिकों को ईमेल कर अपनी चेतना पर चर्चा कर रहे हैं। शोधकर्ता इस पर एकमत नहीं हैं कि इसमें समझ दिखती है या फिर ट्रेनिंग डेटा की नकल।
रिसर्च हाइलाइट्स
Google WeatherNext 3. Google DeepMind और Google Research ने WeatherNext 3 पेश किया है। यह वैश्विक मौसम मॉडल रीयल-टाइम सैटेलाइट डेटा से सीखता है और पुराने मॉडलों की तुलना में 5x अधिक स्पष्ट पूर्वानुमान देता है। Operational WeatherBench पर यह पारंपरिक और AI बेसलाइन दोनों को पीछे छोड़ देता है।
MoE राउटर क्षमता ट्वीक. एक पेपर में दिखाया गया है कि Qwen 3.6 35B A3B के आखिरी लेयरों में एक्सपर्ट सेलेक्शन बजट बढ़ाने से MMLU-Pro पर बिना रीट्रेनिंग के रीज़निंग टोकन में 8.5% की कमी आती है। Succinct Convergence नाम की यह तकनीक केवल निर्णायक लेयरों में अतिरिक्त एक्सपर्ट जोड़ती है।
Fable 5.1: 1653 पहेली का समाधान. Anthropic के Claude Fable 5.1 ने सदियों पुरानी संख्या पहेली Cyphral Distich को व्यवस्थित ट्रायल और एरर से 44 मिनट में डिकोड कर लिया। समाधान में राजा चार्ल्स द्वितीय का समर्थन करने वाला संदेश छिपा था।
आज के लिए बस इतना ही - लगभग 5 मिनट का पठन।