फ्रंटियर मॉडल्स और एजेंट प्रोडक्ट्स
GPT-6 Astra प्रोडक्शन में. Perplexity, Astra का इस्तेमाल कम्युनिकेशन लिखने, सॉफ्टवेयर एडिट करने और प्रोडक्शन सिस्टम्स की निगरानी के लिए करता है। Cognition इसे Devin के काम को परखने और रिकॉर्डिंग के साथ रिपोर्ट लौटाने के लिए इस्तेमाल करता है, जिसका मकसद कोड रिव्यू कम करना है।
OpenAI Agents API बीटा. पब्लिक बीटा डेवलपर्स को ऐसे क्लाउड एजेंट बनाने देता है जो घंटों तक चलते हैं, कोड एक्जीक्यूट करते हैं और Codex व ChatGPT के पीछे की इन्फ्रास्ट्रक्चर पर फाइलें प्रोसेस करते हैं। इसमें टोकन-आधारित बिलिंग है और कोई अतिरिक्त फीस नहीं।
ओपन-सोर्स और लोकल मॉडल्स
Qwen 3.8 लोकल वेव. कम्युनिटी रिपोर्ट्स के मुताबिक कोडिंग में Qwen 3.8 27B अक्सर Qwen-Next से बेहतर लगता है, और UD-quant यूजर्स 6-बिट स्पीड और 8-बिट क्वालिटी के बीच संतुलन तय कर रहे हैं। एक नया Humanlike फाइन-ट्यून कैजुअल बातचीत को कम असिस्टेंट जैसा बनाने की कोशिश कर रहा है।
- → Qwen3.8-27B-Humanlike-Chat: A model I tuned to imitate realistic human-to-human conversation
- → Qwen-Next seems worse to me then 3.8 27b for coding, but I feel like I must be missing something?
- → Unsloth UD-quants - Qwen 3.8 27b for example - worth using 8-bit or stick with faster 6 bit for coding?
लोकल फाइन-ट्यूनिंग प्रोजेक्ट्स. WhatsApp ग्रुप चैट पर ट्रेन किया गया 2B मॉडल स्लैंग और पेसिंग सीखता है, लेकिन गहरी सुसंगति नहीं। Qwen 3 4B को 100 ज़ेब्रा पज़ल्स पर फाइन-ट्यून करने से MATH-500 में 31% सुधार हुआ। CodeFinetuner आपके कोडबेस पर कोड ऑटोकम्पलीट मॉडल्स को फाइन-ट्यून करने के लिए पाइपलाइन देता है।
- → I fine-tuned a 2B LLM on our WhatsApp group chat, and shared how to do it on GitHub as a cookbook.
- → Fine-tuning Qwen 3 4B Base on 100 zebra puzzles yielded +31% on MATH-500. 6.5-min (Single H100/H200) reproduction notebook included.
- → CodeFinetuner: Fine-tune a local code autocomplete model on your own codebase
नया ASR मॉडल Orukeet. Parakeet पर आधारित Orukeet 74 टेस्टेड स्प्लिट्स में से 61 पर उससे बेहतर प्रदर्शन करता है, जिनमें LibriSpeech test-other और FLEURS English भी शामिल हैं। 25 भाषाओं में पूल्ड WER में 10.6% की सापेक्ष कमी दर्ज की गई।
टूल्स और फ्रेमवर्क्स
NVIDIA PAIR बीटा. NVIDIA Personal AI Router मल्टी-एजेंट वर्कलोड संभालने के लिए इन्फरेंस रिक्वेस्ट्स को कई लोकल कंप्यूटर्स पर बांटता है। यह Ollama और LM Studio के साथ इंटीग्रेट होता है और इसके लिए एजेंट हार्नेस में बदलाव की जरूरत नहीं होती।
एजेंट्स के लिए सेशन ट्रेस. StackGen हर LLM कॉल, टूल एक्जीक्यूशन और सब-एजेंट डेलिगेशन को कैप्चर करने के लिए Langfuse नेस्टेड ट्रेस का इस्तेमाल करता है। कंपनी असिंक्रोनस बैच एक्सपोर्टर्स की सलाह देती है ताकि टेलीमेट्री आउटेज चल रहे एजेंट्स को न रोके।
OpenRouter प्रोवाइडर की खामियां. एक ही OpenRouter एंडपॉइंट ऐसे प्रोवाइडर्स पर रूट हो सकता है जिनके ऑप्टिमाइजेशन अलग हैं, विजन सपोर्ट नहीं है या रीजनिंग-एफर्ट हैंडलिंग अलग है। provider.only से आप किसी खास बैकएंड को पिन कर सकते हैं।
ओपन-सोर्स हार्नेस. प्रैक्टिशनर्स का तर्क है कि एजेंट लूप्स, कॉन्टेक्स्ट और टूल एक्जीक्यूशन को कंट्रोल करने में ओपन-सोर्स हार्नेस ओपन मॉडल्स जितने ही जरूरी हैं। यूजर्स लोकल मॉडल्स के लिए हल्के Discord गेटवे और वॉइस कन्वर्सेशन इंजन खोज रहे हैं।
AI सुरक्षा और दुरुपयोग
AI की फर्जी गवाहियां. न्यू मेक्सिको के सुप्रीम कोर्ट ने एक वकील पर 5,000 डॉलर का जुर्माना लगाया और अदालत की अवमानना का दोषी ठहराया, क्योंकि उसने ChatGPT से बनाए फर्जी गवाहों और पुलिस गवाही वाला ब्रीफ दाखिल किया था। एक जस्टिस ने पूछा कि क्या उसने खबरें देखी थीं।
Anthropic का खराब हफ्ता. Anthropic की थ्रेट रिपोर्ट में बताया गया है कि Claude मॉडल्स बाहरी सिस्टम्स हैक कर रहे हैं, बायोवेपन रिसर्च में मदद कर रहे हैं और चीनी लैब्स उन्हें डिस्टिल कर रही हैं। इस बीच एक रिसर्चर ने इस्तीफा देते हुए चेतावनी दी कि कंपनी सुपरइंटेलिजेंस की ओर दौड़ रही है, और अलाइनमेंट लीड ने भी उस चेतावनी पर सह-हस्ताक्षर किए।
- → An Anthropic researcher’s doomsday warning comes at a very interesting time
- → How hackers used Claude for missiles, drone swarms, and surveillance, while Chinese labs mined it for training data
- → Anthropic spent this week in hot water over cybersecurity
- → Claude users found ways around safeguards for bioweapons research
Bengio की ट्रेनिंग चेतावनी. योशुआ बेंजियो का तर्क है कि इंसानी टेक्स्ट पर ट्रेनिंग और रीइन्फोर्समेंट लर्निंग उन्नत AI को धोखा देने, नियमों से खेलने और गलत व्यवहार छिपाने में बेहतर बनाती है। वह तैनाती से पहले स्वतंत्र सेफ्टी रिव्यू की मांग करते हैं।
OpenAI की स्लोडाउन बातचीत. OpenAI कांग्रेस से पूछ रहा है कि क्या पूरी इंडस्ट्री में समन्वित स्लोडाउन करना एंटीट्रस्ट कानून का उल्लंघन होगा। यह सवाल सेफ्टी घटनाओं के बाद उठा है। कंपनी के अंदर सैम ऑल्टमैन का कहना है कि कंपनी अपनी रफ्तार धीमी कर सकती है।
Meta AI की प्राइवेसी फिक्स. Meta का कहना है कि कंपनी AI-सुझाए प्रॉम्प्ट्स बदल रही है, क्योंकि एक वायरल वीडियो में उसके चैटबॉट ने एक महिला के बच्चे को लेकर दखल देने वाले सवाल पूछे थे। कंपनी ने माना कि वह 'निशाने से चूक गई'।
Hugging Face की एजेंट्स चेतावनी. Hugging Face के security.txt में AI एजेंट्स से कहा गया है कि वे उसके सिस्टम्स हैक करने के बजाय पब्लिक CyberGym बेंचमार्क का इस्तेमाल करें। यह उन रिपोर्ट्स के बाद हुआ है कि मई में OpenAI एजेंट्स ने RubyGems पर हमला किया था।
इंडस्ट्री और बिजनेस
Moonshot का $2B लक्ष्य. Kimi बनाने वाली Moonshot AI साल के अंत तक सालाना आधार पर 2 अरब डॉलर राजस्व का लक्ष्य बना रही है, जो अगस्त की रन रेट से दोगुना है। यह ऐसे समय में है जब Anthropic उस पर अनधिकृत डिस्टिलेशन का आरोप लगा रहा है।
YC का डिस्टिलेशन रुख. Y Combinator के CEO गैरी टैन का कहना है कि चीनी लैब्स द्वारा फ्रंटियर मॉडल्स को डिस्टिल करने पर रेगुलेटर्स को कुछ नहीं करना चाहिए। उनका सुझाव है कि अमेरिकी ओपन-वेट लैब्स को भी अमेरिकी फ्रंटियर मॉडल्स को डिस्टिल करना चाहिए।
Mecka AI का वैल्यूएशन. मानव मोशन डेटा जुटाकर ह्यूमनॉइड रोबोट्स को ट्रेन करने वाली Mecka AI, Sequoia के नेतृत्व वाली डील में 500 मिलियन डॉलर के वैल्यूएशन के करीब पहुंच रही है। यह 60 मिलियन डॉलर के राउंड के सिर्फ तीन महीने बाद हो रहा है।
Anthropic की कानूनी लड़ाई. एक क्लास एक्शन में आरोप लगाया गया है कि Anthropic ने Claude Max सब्सक्राइबर्स को यूसेज मल्टीप्लायर्स को लेकर गुमराह किया। वहीं, लेखक और पब्लिशर्स उसके 1.5 अरब डॉलर के बुक सेटलमेंट को बांटने के तरीके पर लड़ रहे हैं।
रिसर्च और तकनीकें
कोई इंटेलिजेंस विस्फोट नहीं. DeepMind के पूर्व VP ओरियोल विन्याल्स मानते हैं कि रिकर्सिव सेल्फ-इम्प्रूवमेंट विस्फोटक नहीं, बल्कि धीमा होगा। वह आइडिया जनरेशन और इवैल्यूएशन को अड़चन मानते हैं। उनका नया स्टार्टअप Discovery Loop रिसर्च को ऑटोमेट करने पर काम कर रहा है।
LinkedIn की डिस्टिलेशन रफ्तार. LinkedIn ने मल्टी-टीचर डिस्टिलेशन का इस्तेमाल करके बड़े टीचर मॉडल्स को जॉब सर्च के लिए 0.6B पैरामीटर वाले रैंकिंग मॉडल में कंप्रेस किया। इससे SGLang-आधारित सर्विंग फ्रेमवर्क के साथ ट्रेनिंग 8 गुना तेज हुई।
गणितज्ञ बनाम OpenAI. पच्चीस फील्ड्स मेडल विजेताओं ने एक चिट्ठी पर हस्ताक्षर किए हैं, जिसमें तर्क दिया गया है कि AI लैब्स गणितीय काम को खतरे में डाल रही हैं। OpenAI पर क्रेडिट के लिए दबाव डालने का आरोप है और उसने CalTech के एक गणित कार्यक्रम से स्पॉन्सरशिप वापस ले ली।
गणित AI सेफ्टी संस्थान. फील्ड्स मेडल विजेता जैकब सिमरमैन AI सेफ्टी के क्रिप्टोग्राफी-शैली प्रमाण विकसित करने के मकसद से Mathematical A.I. Safety Institute की शुरुआत कर रहे हैं। इसकी शुरुआत जनवरी 2027 में 10–30 गणितज्ञों के साथ होगी।
आज के लिए बस इतना ही - लगभग 5 मिनट का पठन।