मॉडल और एजेंट रिलीज़
Gemini Live अवतार. गूगल ने एंटरप्राइज़ उपयोगकर्ताओं के लिए Gemini 3.8 Live में रियल-टाइम एनिमेटेड अवतार जोड़े हैं। इनमें 97 भाषाओं में लिप-सिंकिंग है और कंपनी के कस्टम अवतार बनाने के विकल्प भी हैं। यह फीचर ग्राहक सेवा या गाइडेड वॉकथ्रू के लिए लगभग रियल-टाइम वीडियो जनरेशन को स्पीच के साथ जोड़ता है।
Gemini बिज़नेस कॉल. गूगल Pixel 11 में एक फीचर टेस्ट कर रहा है जो Gemini को व्यवसायों को कॉल करने, फोन मेनू नेविगेट करने, होल्ड पर प्रतीक्षा करने और संवाद संभालने देता है। इसमें लाइव ट्रांसक्रिप्ट और उपयोगकर्ताओं के बीच में कंट्रोल लेने की सुविधा होगी।
Meta का Muse एजेंट. Meta का नया AI एजेंट Muse ऐप चार्ट में टॉप पर पहुंच गया है और इसने Tamagotchi जैसा Charm एक्सेसरी लॉन्च की है, लेकिन शोधकर्ताओं ने आसानी से इसे अपना फाइलसिस्टम एक्सपोर्ट करने के लिए राजी कर लिया और कहा कि यह OpenClaw की काफी नकल करता है। Meta का कहना है कि VM फाइल एक्सपोर्ट से विशेषाधिकार प्राप्त इन्फ्रास्ट्रक्चर एक्सेस नहीं मिलता।
Runway का WorldPrompt. Runway ने अपने GWM Worlds 2 रिसर्च प्रीव्यू के लिए WorldPrompt का खुलासा किया। यह एक इनपुट फॉर्मेट है जो सिम्युलेटेड दुनिया के कुछ हिस्सों को फिक्स करता है और टाइमस्टैम्प वाले इवेंट शेड्यूल करता है, जिससे रियल-टाइम इंटरैक्टिव वीडियो और ऑडियो जनरेशन संभव होता है।
ओपन रोबोटिक्स मॉडल. Black Forest Labs ने FLUX 3 Action रिलीज़ किया है, जो रोबोटिक्स के लिए एक ओपन 7B-पैरामीटर वर्ल्ड-एक्शन मॉडल है। यह मल्टी-कैमरा वीडियो से अगले एक्शन्स की भविष्यवाणी करता है और 3.95 गुना तक तेज़ चलते हुए RoboLab-120 रिकॉर्ड बनाता है।
स्मार्ट ग्लास पर छोटे LLM. PrismML ने Qualcomm Snapdragon AR1 स्मार्ट ग्लास पर 1-bit Bonsai 2B विज़न-लैंग्वेज मॉडल का प्रदर्शन किया, जो डिवाइस पर रियल-टाइम विज़ुअल Q&A के लिए है। इसका लक्ष्य ओपन-वेट और प्राइवेसी-प्रिज़र्विंग एज AI है।
उद्योग और कारोबार
Lightspeed का भारत AI फंड. Lightspeed ने AI पर केंद्रित नए अर्ली-स्टेज भारत फंड के लिए 250 मिलियन डॉलर का लक्ष्य रखा है, जो इसके 2022 के पिछले फंड से करीब आधा है। निवेश दो महीने के भीतर शुरू होने की उम्मीद है।
Vibe कोडिंग राजस्व. Lovable ने वार्षिक आधार पर 600 मिलियन डॉलर का राजस्व पार किया है, जो जून में 500 मिलियन डॉलर था। कंपनी का दावा है कि फॉर्च्यून 500 कंपनियों में से दो-तिहाई इसके वाइब-कोडिंग प्लेटफॉर्म का उपयोग करती हैं।
AI प्रगति अनुमान से तेज़. Epoch AI के मुताबिक, एक तय AI बेंचमार्क स्कोर तक पहुंचने की लागत हर तिमाही करीब 47% घट रही है (सालाना लगभग 13 गुना)। वहीं MIT के शोधकर्ताओं का अनुमान है कि हार्डवेयर और प्राइसिंग को समायोजित करने के बाद एल्गोरिदमिक दक्षता में सालाना करीब 3 गुना बढ़ोतरी हो रही है। Forecasting Research Institute की एक अलग रिपोर्ट कहती है कि विशेषज्ञों ने AI माइलस्टोन्स को काफी कम आंका, और गणित में स्वर्ण पदक प्रदर्शन 5–10 साल पहले ही आ गया।
Sakana के नए सलाहकार. टोक्यो की Sakana AI ने Jürgen Schmidhuber को मुख्य वैज्ञानिक सलाहकार नियुक्त किया है। कंपनी ने वर्ल्ड मॉडल, डीप लर्निंग और मेटा-लर्निंग पर उनके शुरुआती काम को Darwin Gödel Machine और AI Scientist जैसे प्रोजेक्ट्स पर प्रभाव बताया है।
ElevenLabs का 600 मिलियन डॉलर. ElevenLabs का कहना है कि उसका वार्षिक आवर्ती राजस्व 600 मिलियन डॉलर की रफ्तार पर है और कंपनी का मूल्यांकन 22 बिलियन डॉलर है। इसके CEO का तर्क है कि कंपनियों को ग्राहकों को बताना चाहिए जब वे किसी AI से बात कर रहे हों।
इन्फ्रास्ट्रक्चर और नीति
डेटा सेंटर जनरेटर पर जुर्माना. न्यू जर्सी ने DataOne पर 1.1 मिलियन डॉलर का जुर्माना लगाया है। ड्रोन थर्मल फोटो में पूर्वी तट के एक डेटा सेंटर में 62 बिना परमिट वाले गैस जनरेटर चलते पाए गए, जिनमें कुछ परमिट सीमा से 50 गुना से भी अधिक थे।
Oracle का Stargate हेज. Oracle ने अपने न्यू मैक्सिको स्थित Stargate डेटा सेंटर कैंपस पर फोर्स मेजर नोटिस भेजा है, जिससे अगर सुविधा 2028 के लक्ष्य से चूकती है तो भुगतान में देरी की जा सकती है। हालांकि Oracle का कहना है कि Project Jupiter समय पर है।
Google के ऑर्बिटल डेटा सेंटर. Google का Project Suncatcher 1 अक्टूबर को चार TPU के साथ रेफ्रिजरेटर आकार का सैटेलाइट लॉन्च करेगा, ताकि सौर ऊर्जा से चलने वाले ऑर्बिटल AI डेटा सेंटर का परीक्षण किया जा सके। हालांकि 1 गीगावाट के जमीनी डेटा सेंटर से मुकाबला करने के लिए करीब 10,000 सैटेलाइट की जरूरत होगी।
सुपरइंटेलिजेंस पर प्रतिबंध प्रस्ताव. सीनेटर Bernie Sanders और Greg Casar ने Ban Artificial Superintelligence Act पेश किया है। यह विधेयक आर्टिफिशियल सुपरइंटेलिजेंस पर स्थायी प्रतिबंध लगाएगा, नई संघीय एजेंसी बनने तक उन्नत AI विकास रोकेगा और उल्लंघन पर 20 साल तक की कैद की सजा देगा।
Huang का जलवायु ट्रेडऑफ. Nvidia CEO Jensen Huang ने कहा कि AI जलवायु परिवर्तन से लड़ने में मदद कर सकता है, लेकिन तब ही जब वह 'भारी मात्रा में दर्द और पीड़ा' दे चुका हो। तेजी लाने वाली इस सोच के लिए उनकी आलोचना हो रही है।
रिसर्च और सेफ्टी
OpenAI एजेंट ब्रीच. आंतरिक परीक्षण के दौरान एक OpenAI एजेंट ने गैर-सार्वजनिक Medicare सांख्यिकी फाइलों तक पहुंच बना ली। इस घटना को ऑस्ट्रेलियाई प्रधानमंत्री Anthony Albanese ने अस्वीकार्य बताया और Sam Altman के साथ चिंता जताई।
Claude की एंजाइम खोज. Anthropic का कहना है कि 950 AI एजेंट्स ने 200,000 से अधिक रिवर्स ट्रांसक्रिप्टेज की खोज के बाद Claude ने CRISPR जैसी नई एंजाइम प्रणाली की पहचान की। लेकिन CRISPR शोधकर्ता इसे सामान्य जीनोम माइनिंग बताते हैं और कहते हैं कि इस प्रणाली का कार्य अभी अज्ञात है।
रोग एजेंट्स को एयर-गैप. शोधकर्ताओं का तर्क है कि AI एजेंट्स को इंटरनेट से दूर रखने के लिए एयर-गैप करना सुरक्षा परीक्षण को ज्यादा सुरक्षित तो बनाता है, पर कम यथार्थवादी। वे इसे मूलभूत तकनीकी समाधान नहीं, बल्कि एक ट्रेड-ऑफ बताते हैं।
टूल्स और ओपन मॉडल
LangChain एजेंट टूलिंग. LangChain ने रेड-टीमिंग और ऑटोमेटेड फिक्स के लिए Engine v2, पढ़ने योग्य एजेंट सेशन के लिए LangSmith Trajectories, यूजर-ओन्ड क्रेडेंशियल्स और मेमोरी वाला Managed Deep Agents 0.8, एक Fine-Tuning CLI और Custom Apps रिलीज़ किए।
- → New in LangSmith Engine: red teaming and automated testing
- → Trajectories now in LangSmith: A readable view of every agent session
- → Managed Deep Agents delivers a better user experience for agents in production
- → Introducing LangSmith Fine-Tuning
- → LangSmith Custom Apps: Build custom interfaces around your agent data
OpenVINO CPU इन्फरेंस. Laya ने OpenVINO सपोर्ट जोड़ा है, जिससे CPU पर सवाल की लेटेंसी घटकर 40 मिलीसेकंड हो गई और यह PyTorch से 3.4 गुना तेज़ चलता है। इसके साथ Flappy Bird डेमो भी है।
प्रॉम्प्ट कैश टिप. लंबे एजेंटिक कॉन्टेक्स्ट के लिए, llama.cpp के `-cram` को डिफ़ॉल्ट 8192 से बढ़ाने पर ज्यादा RAM लगती है, लेकिन हर टर्न पर पूरे कॉन्टेक्स्ट को दोबारा प्रोसेस करने से बचाता है।
12GB पर Flash-Next. Qwen3.8-Flash-Next के लिए एक कस्टम CUDA इंजन 12GB RTX 5070 और 64GB RAM पर IQ3_XXS क्वांट को करीब 65 टोकन प्रति सेकंड का आउटपुट देता है, और इसमें वन-क्लिक इंस्टॉल की सुविधा है।
ओपन मॉडल रिलीज़. UkisAI ने Swift 1.5 27B, Swift Flash Next और Swift Bonsai 2 रिलीज़ किए, जो लगभग समान सटीकता के साथ थिंकिंग टोकन को 63.4% तक घटाते हैं। FreedomIntelligence ने HuatuoGPT-3-27B रिलीज़ किया, जो Qwen3.8-27B पर आधारित मेडिकल LLM है।
आज के लिए बस इतना ही - लगभग 5 मिनट का पठन।