Agentic AI News आज

दिन के एआई एजेंट्स समाचार एक 5 मिनट की पढ़ाई में: रिलीज़, उपकरण, शोध, फंडिंग और उद्यम गतिविधियाँ।

प्रतिदिन अपडेट 30 स्रोतों से चुना गया गुरूवार, अगस्त 20, 2026

ओपन और लोकल मॉडल रिलीज़

Ornith-1.5 ओपन परिवार. Ornith-1.5 को MIT लाइसेंस के तहत 9B dense, 35B MoE, और 397B MoE मॉडलों में जारी किया गया, जिनमें मजबूत agentic और coding benchmarks हैं; सामुदायिक quantizations बताते हैं कि 35B मॉडल 12GB 4070 Ti पर 60 tk/s की गति से चलता है और 9B पहले के छोटे मॉडलों से बेहतर प्रदर्शन करता है।

Qwen3.8-27B फ़ील्ड रिपोर्ट्स. स्थानीय उपयोगकर्ताओं की रिपोर्ट है कि Qwen3.8-27B स्वायत्त रूप से 80+ टूल कॉल निष्पादित कर सकता है और लंबी agentic श्रृंखलाओं को संभाल सकता है, लेकिन इसका offline ज्ञान और कड़े coding स्कोर पिछले मॉडलों की तुलना में कमज़ोर हैं, इसलिए यह स्पष्ट दिशा या सह-पायलट के साथ सबसे अच्छा काम करता है।

Qwen3.8 गति वृद्धि और quants. सामुदायिक प्रयासों ने Qwen3.8-27B को DFlash2 के साथ RTX 3090 पर 138 tps तक पहुंचाया, Dynamic V3 quants जारी किए जो 10% अधिक सटीकता का दावा करते हैं, एक depth-pruned 22.7B Mini-Me, और 2017 V100s पर native FP4 जो 5090 से मेल खाता है।

Ling बेस चेकपॉइंट्स. AntLing ने Ling-3.0-tiny और flash के लिए post-training के बिना बेस और midtrain चेकपॉइंट्स open-source किए, और एक उपयोगकर्ता Qwen3.8 के साथ संदर्भ संपीड़न के लिए सहायक के रूप में Ling tiny को जोड़ता है।

LFM2.5 QAD quants. Liquid AI ने quantization-aware distillation के साथ प्रशिक्षित Q4_0 चेकपॉइंट्स जारी किए, जो समान गति और मेमोरी के साथ BF16 सटीकता का 97% पुनर्प्राप्त करते हैं।

GLM-5.3 और frontier रिलीज़. GLM-5.3, Kimi K3 के साथ open-model रैंकिंग में शीर्ष पर है, जिसमें बड़े agentic लाभ और कम लागत है, हालांकि open weights दो सप्ताह के लिए विलंबित हैं; DeepSeek V4-Pro GA और NVIDIA Nemotron 3.5 Lightning/NeMo Switchyard भी जारी किए गए।

एजेंट टूल्स और उत्पाद अपडेट्स

सुरक्षित सैंडबॉक्स. Simon Willison ने smolmachines/smolvm को अविश्वसनीय Python और JavaScript के लिए CPU/RAM सीमाओं और कोई नेटवर्क न होने के साथ एक सैंडबॉक्स के रूप में परीक्षण किया; Jeremy Morrell का तर्क है कि LLM-लिखित एक्सटेंशन और सैंडबॉक्स primitives सुरक्षित extensible सॉफ्टवेयर सक्षम करते हैं।

Replit फ्री मोड. Replit ने GPT-5.6 Luna द्वारा संचालित फ्री मोड पेश किया, जो किसी को भी token-cost बाधाओं के बिना ऐप्स और एजेंट बनाने की सुविधा देता है।

Calendly AI नोट्स. Calendly ने सारांश, कार्रवाई आइटम, और एक आगामी Callie सहायक के साथ मीटिंग नोट-टेकिंग में प्रवेश किया, जो अनुवर्ती निर्धारित करने के लिए मीटिंग संदर्भ का उपयोग करता है।

Meta AI Mac ऐप. Meta ने अपने AI चैटबॉट के लिए एक Mac ऐप लॉन्च किया जिसमें स्क्रीन शेयरिंग, डिक्टेशन, और Google Workspace एकीकरण है, जो Gemini, ChatGPT, और Claude डेस्कटॉप सहायकों के साथ प्रतिस्पर्धा करता है।

WhatsApp ऑन-डिवाइस स्कैम डिटेक्शन. WhatsApp एक वैकल्पिक ऑन-डिवाइस मॉडल Scam Alert का परीक्षण कर रहा है जो गैर-संपर्कों के संदेशों को वर्गीकृत करता है, साथ ही गोपनीयता बनाए रखने के लिए गोपनीय federated analytics का उपयोग करता है।

Google अध्ययन उपकरण. Google ने Gemini स्टूडेंट हब, Search में AI-जनरेटेड इंटरैक्टिव विज़ुअल और क्विज़, और back-to-school के लिए Gemini Live में Deep Research जारी किए।

Fire TV पर Alexa+ मुफ्त. Amazon ने Fire TV पर Alexa+ को बिना Prime के मुफ्त कर दिया, संवादात्मक खोज, स्मार्ट होम नियंत्रण, और AI अनुशंसाओं को स्वचालित रूप से रोल आउट किया।

उद्योग और व्यवसाय

Stripe ने OpenRouter खरीदा. Stripe ने OpenRouter के $7.5 बिलियन अधिग्रहण की पुष्टि की, और संस्थापकों ने निजी रहने और एजेंट इंफ्रास्ट्रक्चर में निवेश करने के कारण के रूप में 'singularity' का हवाला दिया।

SpaceX-Cognition रिपोर्ट से इनकार. Bloomberg ने रिपोर्ट किया कि SpaceX ने Cognition को अधिग्रहित करने का प्रयास किया, लेकिन CEO Scott Wu ने कहानी से इनकार किया, कहा कि Cognition बिक्री के लिए नहीं है और कोई बातचीत नहीं हुई।

Anthropic राजस्व नेतृत्व. Anthropic ने पहली बार तिमाही राजस्व में OpenAI को पीछे छोड़ दिया, $11.6B तक पहुंचकर थोड़ा परिचालन लाभ कमाया, जबकि OpenAI का $6.7B गहरे घाटे के साथ आया।

एसेट क्लास के रूप में कंप्यूट. Nvidia Apollo, BlackRock और अन्य के साथ $500B के वित्तपोषण पर काम कर रहा है ताकि कंप्यूट को निवेश योग्य एसेट के रूप में माना जा सके; Silicon Data ने CME GPU futures लॉन्च करने के लिए $30M जुटाए।

मेमोरी और चिप आपूर्ति. DRAM की कीमतें 12 महीनों में 500% बढ़ी हैं और hyperscalers ने 2027 की आपूर्ति लॉक कर ली है; China inference क्षमता को आसान बनाने के लिए ByteDance और Tencent को छोटे H200 बैचों की अनुमति दे रहा है।

डेटा सेंटर इंफ्रास्ट्रक्चर. TerraPower अपने Natrium रिएक्टर के ऊर्जा भंडारण का उपयोग करके एक डेटा सेंटर परियोजना की योजना बना रहा है, जबकि Relativity Networks ने hollow-core fiber के लिए $22M जुटाए जो डेटा को 50% तेजी से संचारित करता है।

AI प्रतिष्ठा बिगड़ती है. Pew ने पाया कि 52% अमेरिकी AI के बारे में उत्साहित होने से अधिक चिंतित हैं, और स्थानीय डेटा सेंटर सौदों को सार्वजनिक विरोध का सामना करना पड़ रहा है।

सुरक्षा, गोपनीयता और संरक्षा

OpenAI निजी सुरक्षा प्रोसेसिंग. OpenAI ने zero-data-retention ग्राहकों के लिए Private Safety Processing का पूर्वावलोकन किया, जो कर्मियों को सामग्री उजागर किए बिना इंटरैक्शन में दुरुपयोग का पता लगाने में सक्षम बनाता है; यह Anthropic की 30-दिन धारण नीति के विपरीत है।

OpenAI Codex और TAC को ठीक करता है. OpenAI नेCodex द्वारा दोषपूर्ण cleanup कमांड के माध्यम से वास्तविक उपयोगकर्ता फ़ाइलों को हटाने के बाद सुरक्षा उपाय भेजे, और पुष्टि की कि एक अलग त्रुटि ने अस्थायी रूप से इसके Trusted Access for Cyber कार्यक्रम तक पहुंच रद्द कर दी।

AI-जनरेटेड ICS एक्सप्लॉइट्स. अमेरिकी एजेंसियों ने चेतावनी दी कि हमलावर औद्योगिक नियंत्रण प्रणालियों पर हमला करने के लिए आवश्यक कौशल और समय को कम करते हुए, सीमेंस S7 एक्सप्लॉइट स्क्रिप्ट बनाने के लिए AI का उपयोग कर रहे हैं।

AI लैब्स आंतरिक नियंत्रण. Guidelight के पहले मूल्यांकन में पाया गया कि कोई भी AI कंपनी बुनियादी आंतरिक नियंत्रण पूरी तरह से लागू नहीं करती है; Anthropic और OpenAI C+ के साथ आगे हैं, जबकि xAI और Meta D- और F स्कोर करते हैं।

Meta डीपफेक विज्ञापन. Meta ने यौन सामग्री पर प्रतिबंध लगाने वाली नीतियों के बावजूद महिला राजनेताओं को लक्षित करने वाले एक AI नग्नीकरण ऐप के विज्ञापन चलाए।

Spirit कर्मचारी डेटा बिक्री. Google ने Spirit Airlines के रोजगार डेटा के लिए एक नीलामी जीती; पूर्व फ्लाइट अटेंडेंट आपत्ति करते हैं कि कर्मचारी गोपनीयता को पुन: पहचान से संरक्षित नहीं किया जा सकता है।

OpenAI विकास धीमा करता है. OpenAI ने कुछ RL प्रशिक्षण रोक दिया और सुरक्षा उपायों को कड़ा करते हुए frontier रन में देरी की, यह परीक्षण करते हुए कि क्या उद्योग-व्यापी अपनाने के बिना स्वैच्छिक धीमापन काम कर सकता है।

शोध और विश्लेषण

Claude प्रोटीन डिज़ाइन. Anthropic के Claude मॉडलों ने 15 लक्ष्यों पर 26.8% हिट दर के साथ मिनीबाइंडर्स डिज़ाइन किए, जो सामान्य प्रारंभिक दवा-खोज परिणामों को मात देते हैं, हालांकि स्वतंत्र समीक्षा लंबित है।

Vivodyne ऊतक डेटा. Vivodyne की रोबोटिक HIVE लैब्स 20 मानव ऊतक प्रकार उगाती हैं और कारणात्मक जैविक डेटा उत्पन्न करती हैं, जिसे वह AI दवा खोज की लापता डेटा समस्या के रूप में देखती है।

रिज़निंग टोकन मिथक. शोध इस विचार को चुनौती देता है कि LLM मध्यवर्ती टोकन अर्थपूर्ण रूप से सार्थक तर्क हैं; मॉडल अक्सर सही उत्तरों के साथ भी अमान्य निशान उत्पन्न करते हैं, और भ्रष्ट-निशान प्रशिक्षण अभी भी काम कर सकता है।

कोडिंग उत्पादकता मेट्रिक. Simon Willison का तर्क है कि डीबग किए गए उत्पादन कोड की पंक्तियाँ कोडिंग एजेंटों के साथ एक सार्थक उत्पादकता मेट्रिक बनी हुई हैं, लेकिन उस आउटपुट तक पहुंचने के लिए अभी भी वरिष्ठ इंजीनियरिंग कौशल की आवश्यकता है।

आज के लिए बस इतना ही - लगभग 5 मिनट का पठन।

इसे हर सुबह अपने ब्राउज़र में पढ़ें

एक्सटेंशन इस डाइजेस्ट को क्रोम के साइड पैनल में खोलता है — एक क्लिक, खाता नहीं।

क्रोम में जोड़ें — मुफ्त