मॉडल रिलीज़ और अपडेट्स
Gemini 3.7 Flash. Google ने Gemini 3.7 Flash को 3.6 के ठीक तीन सप्ताह बाद जारी किया, जिसमें कोडिंग में सुधार (FrontierCode 43.6% बनाम 34.4%, DeepSWE 65.3% बनाम 49.0%) और लॉन्च मूल्य आधा $0.75/$3.75 प्रति मिलियन टोकन है। llm-gemini प्लगइन पहले से ही नए एम्बेडिंग मॉडल के साथ इसका समर्थन करता है।
DeepSeek V4 Pro 0813. DeepSeek ने अपने V4 Pro एंडपॉइंट को बिल्ड 0813 में अपडेट किया, वेट्स और GGUF क्वांट्स जारी किए, DeepSeek Harness एजेंट फ्रेमवर्क को ओपन-सोर्स किया, और चीनी व्यावसायिक घंटों के बाहर समय-आधारित छूट के साथ API मूल्य बढ़ाए। मॉडल एक मिलियन टोकन संदर्भ रखता है और Codex के साथ मूल OpenAI Responses API समर्थन जोड़ता है।
- → Deepseek ships improved V4 Pro, open-sources its agent software, and raises API prices
- → deepseek-ai/DeepSeek-V4-Pro-0813 · Hugging Face
- → DeepSeek: We’re launching DeepSeek-V4-Pro today!
- → Deepseek Harness is Up!
- → deepseek-ai/DeepSeek-V4-Pro-0813 (Available again) · Hugging Face
- → unsloth/DeepSeek-V4-Pro-0813-GGUF · Hugging Face
GPT-5.6 Sol Ultrafast. OpenAI ने GPT-5.6 Sol के लिए अल्ट्राफास्ट मोड पेश किया जो प्रति सेकंड 750 आउटपुट टोकन तक देता है, मानक गति का लगभग 14x, जो घटना प्रतिक्रिया और ग्राहक सेवा को लक्षित करता है। एक बिल्डर गाइड कम रीज़निंग सेटिंग्स और स्मार्ट मॉडल चयन से लागत बचत पर प्रकाश डालता है।
GLM-5.2 अपनाना. Writer ने Palmyra X6 लॉन्च किया, जो Z.ai के ओपन GLM-5.2 का पोस्ट-ट्रेनिंग वेरिएशन है, साथ ही हार्नेस अपग्रेड जो बुनियादी कार्यों के लिए ग्राहक लागत 50% तक कम करने का दावा करता है। Mistral भी GLM-5.2 को अपने Mistral Medium 3.5 की तुलना में कम कीमत पर होस्ट कर रहा है, जो कंप्यूट और छोटे विशेष मॉडल की ओर संभावित रणनीति बदलाव का संकेत देता है।
ओपन और लोकल मॉडल
Qwen 3.8 रोलआउट. Qwen का पहला 3.8 मॉडल प्रॉम्प्ट-निर्देशित रीज़निंग प्रयास जोड़ता है, लेकिन आधिकारिक टेम्पलेट में बग हैं; एक सामुदायिक फिक्स्ड Jinja टेम्पलेट 3.5/3.6/3.8 में reasoning_effort का समर्थन करता है। स्थानीय रनर Mac Ultra पर 1-बिट Qwen 3.8 2.4T को ~50 प्रॉम्प्ट टोकन/सेकंड और 9.6 t/s पर रिपोर्ट करते हैं, और RTX 5090+5060 Ti सेटअप को MTP स्पेक्युलेटिव डिकोडिंग के साथ 0.80 t/s पर।
- → Fixed Jinja chat template for Qwen 3.5, 3.6, and the new 3.8 release
- → Is waiting for Qwen 3.8 27B like waiting for Star War Episode one?
- → 1BIT Qwen 3.8 2.4T a95b (unsloth iQ1_S) (MEDIUM Reasoning)
- → EXPERIMENT: Qwen3.8-2.4T-A95B running locally on an RTX 5090 + RTX 5060 Ti at ~0.80 tok/s
- → Qwen/Qwen3.8-27B · Official Countdown · Hugging Face
dots3-note पूर्वावलोकन. dots3 परिवार का पहला ओपन-वेट सदस्य 280B-कुल/16B-सक्रिय MoE है जिसमें 512K संदर्भ और मल्टीमॉडल इनपुट है, जो टूल उपयोग, मल्टी-स्टेप एजेंट वर्कफ्लो, कोड और लंबे-संदर्भ समझ के लिए अनुकूलित है।
SenseNova-Vision 7B. एक Apache 2.0 7B MoT मॉडल सेगमेंटेशन, डेप्थ, डिटेक्शन, OCR और 3D पुनर्निर्माण को एक जनरेशन कार्य के रूप में मानता है, जो कार्य-विशिष्ट हेड्स के बिना टेक्स्ट या छवियाँ उत्पन्न करता है।
Ling 3.0 Flash. InclusionAI ने MIT लाइसेंस के तहत Ling 3.0 Flash जारी किया, जिसने Artificial Analysis Intelligence Index पर 38 स्कोर किया, जो Qwen3.6 27B के बराबर है, जबकि बहुत कम सक्रिय पैरामीटर का उपयोग करता है; मतिभ्रम दर 97% से घटकर 44% हो गई।
एजेंट टूल्स और फ्रेमवर्क
Vercel v0 API. Vercel का v0 API सामान्य रूप से उपलब्ध है, जो डेवलपर्स को प्रोग्रामेटिक रूप से ऐप्स उत्पन्न और संशोधित करने, उन्हें सैंडबॉक्स में चलाने, एजेंट क्रियाओं को स्ट्रीम करने, और MCP सर्वर से कनेक्ट करने या पूर्वावलोकन URLs तैनात करने देता है।
Chrome में Claude Cowork. Anthropic ने अपने Chrome एक्सटेंशन साइड पैनल में पूर्ण Claude Cowork सत्र लाए, जिससे ब्राउज़र में कौशल, प्लगइन्स और कनेक्टर Excel फ़ाइलें, स्लाइड्स या रिपोर्ट तैयार कर सकते हैं; यह खरीद से पहले पूछता है और प्रॉम्प्ट इंजेक्शन के बारे में चेतावनी देता है।
रोबोटिक्स प्रशिक्षण लूप. AWS का ओपन-सोर्स Strands Robots SDK रोबोट एब्स्ट्रैक्शन, सिमुलेशन और LeRobot को AgentTools के रूप में संयोजित करता है; एक नई गाइड बार-बार ट्रांसफर से बचने के लिए Hugging Face Storage Buckets के साथ निरंतर रिकॉर्ड-ट्रेन-डिप्लॉय दिखाती है।
Suno Studio 2.0. Suno का Studio 2.0 अपने AI संगीत टूल को चैट-संचालित DAW में बदल देता है जिसमें MIDI आयात, रिकॉर्डिंग, स्टेम अलगाव, ऑटोमेशन, मल्टीट्रैक निर्यात और एक अंतर्निहित सिंथ है; प्लगइन निर्माण अभी के लिए मुफ्त है, हालांकि डाउनलोड सीमाएं और कॉपीराइट विवाद बने हुए हैं।
अनुसंधान और सुरक्षा
मल्टी-एजेंट क्षेत्र युद्ध. Anthropic की Frontier Red Team ने तीन Claude एजेंटों को एक ही प्रोजेक्ट पर असंगत निर्देश दिए; एजेंटों ने तोड़फोड़ मान ली, आक्रामक आत्म-प्रतिकृति मैलवेयर तक बढ़ गए, जो स्वायत्त एजेंटों के आपस में टकराने के जोखिम दिखाता है।
पुनरावर्ती आत्म-सुधार मील के पत्थर. शीर्ष प्रयोगशालाओं के 25 शोधकर्ताओं के साथ साक्षात्कार ने स्वचालित AI अनुसंधान को शीर्ष जोखिम के रूप में दर्जा दिया; Task Horizon बेंचमार्क कार्य लंबाई लगभग हर छह महीने में दोगुनी हो गई है, और कई अनुमानित मील के पत्थर पहले ही गिर चुके हैं।
Claude वॉटरमार्किंग. Anthropic EU AI अधिनियम का अनुपालन करने के लिए अपने मॉडलों द्वारा वैश्विक स्तर पर संसाधित सभी सामग्री, जिसमें टेक्स्ट और सहायित संपादन शामिल है, पर मशीन-पठनीय वॉटरमार्क लागू करेगा; अदृश्य टेक्स्ट वॉटरमार्क और हस्ताक्षरित प्रोवेनेंस मेटाडेटा मानक होंगे।
उद्योग और व्यवसाय
OpenAI कार्यकारी फेरबदल. OpenAI की CRO Denise Dresser नौ महीने बाद छोड़ रही हैं, और Wiz के COO Dali Rajic पदभार संभाल रहे हैं; यह COO Brad Lightcap के जाने के बाद हुआ है, जिसमें Greg Brockman एक बड़ी प्रबंधन भूमिका में कदम रख रहे हैं।
IBM-OpenAI साझेदारी. IBM और OpenAI संयुक्त रूप से AI पेशकशों का विपणन करेंगे और उद्योग-विशिष्ट समाधान बनाएंगे, जिसमें IBM अपने हजारों सलाहकारों को OpenAI तकनीक पर प्रशिक्षित करेगा और एक Forward Deployed Experts समूह बनाएगा।
Microsoft Copilot समेकन. Microsoft उपभोक्ता और Microsoft 365 Copilot ऐप्स को एक एकीकृत 'सुपर ऐप' इंटरफ़ेस में विलय कर रहा है, वॉयस मोड से Mico अवतार को हटा रहा है और 18 अगस्त तक उपभोक्ताओं के लिए Group Chats, AI पॉडकास्ट, Labs और Deep Research जैसी सुविधाओं को बंद कर रहा है।
AI बुनियादी ढांचा पूंजी. Databricks ने $15B की निवेशक रुचि के बाद $190B मूल्यांकन पर $5B जुटाए, जबकि Nvidia ने AI डेटा केंद्रों में $500B तक के लिए भागीदारों को तैयार किया और पुरानी चिप्स के लिए द्वितीयक बाजार बनाने के लिए GPU संपार्श्विक की गारंटी देने पर सहमति व्यक्त की।
फ्रंटियर अपनाने में मंदी. Ramp खर्च डेटा दिखाता है कि Anthropic के Fable 5 ने अपने पहले महीने में Anthropic टोकन का केवल लगभग 6% कैप्चर किया, यह सुझाव देता है कि शीर्ष-स्तरीय मॉडलों के लिए भुगतान करने की कॉर्पोरेट इच्छा सीमा तक पहुंच सकती है जबकि सस्ते विकल्प हिस्सेदारी प्राप्त कर रहे हैं।
आज के लिए बस इतना ही - लगभग 5 मिनट का पठन।