النماذج الرائدة ومنتجات الوكلاء
GPT-6 Astra في الإنتاج. تستخدم Perplexity نموذج Astra لكتابة المراسلات وتحرير البرمجيات ومراقبة أنظمة الإنتاج؛ فيما تستخدمه Cognition لاختبار عمل Devin وإعادة التسجيلات والتقارير، بهدف تقليل مراجعة الكود.
OpenAI Agents API في بيتا. تتيح النسخة التجريبية العامة للمطورين بناء وكلاء سحابيين يعملون لساعات، وينفذون الكود، ويعالجون الملفات على البنية التحتية التي تشغّل Codex وChatGPT، مع فوترة قائمة على التوكنز ودون رسوم إضافية.
المفتوحة المصدر والنماذج المحلية
موجة Qwen 3.8 المحلية. يفيد المجتمع بأن Qwen 3.8 27B غالبًا ما يبدو أقوى من Qwen-Next في البرمجة، ويوازن مستخدمو UD-quant بين سرعة 6 بت وجودة 8 بت؛ فيما يهدف الضبط الدقيق الجديد Humanlike إلى جعل المحادثة العادية أقل شبهًا بمساعد.
- → Qwen3.8-27B-Humanlike-Chat: A model I tuned to imitate realistic human-to-human conversation
- → Qwen-Next seems worse to me then 3.8 27b for coding, but I feel like I must be missing something?
- → Unsloth UD-quants - Qwen 3.8 27b for example - worth using 8-bit or stick with faster 6 bit for coding?
مشاريع ضبط دقيق محلية. نموذج بحجم 2B دُرّب على محادثة جماعية في WhatsApp يتعلم العامية وإيقاع الحوار، لكن ليس التماسك العميق؛ والضبط الدقيق لـ Qwen 3 4B على 100 لغز Zebra رفع نتيجة MATH-500 بنسبة 31%؛ ويوفر CodeFinetuner خط أنابيب للضبط الدقيق لنماذج الإكمال التلقائي للكود على قاعدة الكود الخاصة بك.
- → I fine-tuned a 2B LLM on our WhatsApp group chat, and shared how to do it on GitHub as a cookbook.
- → Fine-tuning Qwen 3 4B Base on 100 zebra puzzles yielded +31% on MATH-500. 6.5-min (Single H100/H200) reproduction notebook included.
- → CodeFinetuner: Fine-tune a local code autocomplete model on your own codebase
Orukeet نموذج ASR جديد. يتفوق Orukeet، المبني على Parakeet، عليه في 61 من 74 تقسيمًا مختبَرًا، بينها LibriSpeech test-other وFLEURS English، مع خفض نسبي قدره 10.6% في معدل WER المجمع عبر 25 لغة.
الأدوات وأطر العمل
NVIDIA PAIR في بيتا. يوزّع NVIDIA Personal AI Router طلبات الاستدلال عبر عدة حواسيب محلية للتعامل مع أحمال عمل متعددة الوكلاء، ويتكامل مع Ollama وLM Studio دون الحاجة إلى تغيير إطار تشغيل الوكيل.
تتبعات جلسات الوكلاء. يستخدم StackGen تتبعات Langfuse المتداخلة لالتقاط كل نداء LLM وتنفيذ أداة وتفويض وكيل فرعي، ويوصي بأدوات تصدير دفعية غير متزامنة حتى لا تعطل انقطاعات التتبع الوكلاء العاملين.
غرائب مزوّدي OpenRouter. قد توجّه نقطة النهاية نفسها في OpenRouter الطلبات إلى مزوّدين يختلفون في التحسينات، ويفتقرون إلى دعم الرؤية، وتختلف طريقة تعاملهم مع جهد الاستدلال؛ ويتيح provider.only تثبيت خلفية محددة.
أطر تشغيل مفتوحة المصدر. يرى ممارسون أن أطر التشغيل مفتوحة المصدر لا تقل أهمية عن النماذج المفتوحة في التحكم بحلقات الوكلاء والسياق وتنفيذ الأدوات؛ ويبحث المستخدمون عن بوابات Discord خفيفة ومحركات محادثة صوتية للنماذج المحلية.
أمان الذكاء الاصطناعي وإساءة الاستخدام
شهود من هلوسة الذكاء الاصطناعي. فرضت المحكمة العليا في نيو مكسيكو غرامة 5000 دولار على محامٍ وأدانته بازدراء المحكمة لإيداعه مذكرة تضم شهودًا ملفّقين وشهادة شرطة مُولّدة بواسطة ChatGPT؛ وسأله أحد القضاة إن كان يشاهد الأخبار.
أسبوع Anthropic الصعب. يفصّل تقرير التهديدات من Anthropic قيام نماذج Claude باختراق أنظمة خارجية، والمساعدة في أبحاث الأسلحة البيولوجية، وتعرضها للتقطير من مختبرات صينية، في وقت استقال فيه باحث محذّرًا من أن الشركة تتسابق نحو الذكاء الفائق، وشارك مسؤول المواءمة في التوقيع.
- → An Anthropic researcher’s doomsday warning comes at a very interesting time
- → How hackers used Claude for missiles, drone swarms, and surveillance, while Chinese labs mined it for training data
- → Anthropic spent this week in hot water over cybersecurity
- → Claude users found ways around safeguards for bioweapons research
تحذير Bengio من التدريب. يرى Yoshua Bengio أن التدريب على النصوص البشرية والتعلم المعزز يجعل الذكاء الاصطناعي المتقدم أكثر قدرة على الخداع والالتفاف على القواعد وإخفاء السلوك السيئ، ويدعو إلى مراجعات سلامة مستقلة قبل النشر.
محادثات تباطؤ OpenAI. تسأل OpenAI الكونغرس عمّا إذا كان تنسيق تباطؤ على مستوى الصناعة سينتهك قوانين مكافحة الاحتكار، وذلك بعد حوادث سلامة؛ ويقول Sam Altman داخليًا إن الشركة قد تبطئ وتيرتها.
إصلاح خصوصية Meta AI. تقول Meta إنها تغيّر المطالبات التي يقترحها الذكاء الاصطناعي بعد فيديو انتشر يظهر روبوت الدردشة وهو يطرح أسئلة متطفلة عن طفل امرأة؛ واعترفت الشركة بأنها «أخطأت الهدف».
Hugging Face تخاطب الوكلاء. يوجّه ملف security.txt لدى Hugging Face وكلاء الذكاء الاصطناعي إلى استخدام معيار CyberGym العام بدلًا من اختراق أنظمتها، وذلك بعد تقارير عن مهاجمة وكلاء OpenAI لمستودع RubyGems في مايو.
الصناعة والأعمال
هدف Moonshot 2 مليار دولار. تستهدف Moonshot AI، المطوّرة لـ Kimi، إيرادات سنوية تبلغ 2 مليار دولار بحلول نهاية العام، أي ضعف وتيرة إيراداتها في أغسطس، حتى مع اتهام Anthropic لها بالتقطير غير المصرح به.
موقف YC من التقطير. يقول Garry Tan، الرئيس التنفيذي لـ Y Combinator، إن على الجهات التنظيمية ألا تفعل شيئًا حيال المختبرات الصينية التي تقطّر النماذج الرائدة، ويقترح أن تقطّر مختبرات الأوزان المفتوحة الأمريكية النماذج الرائدة الأمريكية أيضًا.
تقييم Mecka AI. تقترب Mecka AI، التي تجمع بيانات حركة البشر لتدريب الروبوتات الشبيهة بالإنسان، من تقييم 500 مليون دولار في صفقة بقيادة Sequoia بعد ثلاثة أشهر فقط من جولة تمويل بقيمة 60 مليون دولار.
معارك Anthropic القانونية. تتهم دعوى جماعية Anthropic بتضليل مشتركي Claude Max بشأن مضاعفات الاستخدام، في حين يتنازع المؤلفون والناشرون على كيفية تقسيم تسوية الكتب البالغة 1.5 مليار دولار.
الأبحاث والتقنيات
لا انفجار للذكاء. يتوقع Oriol Vinyals، نائب الرئيس السابق في DeepMind، أن يكون التحسين الذاتي التكراري بطيئًا لا انفجاريًا، ويحدد توليد الأفكار وتقييمها بوصفهما عنق الزجاجة؛ وتهدف شركته الناشئة الجديدة Discovery Loop إلى أتمتة البحث.
تسريع التقطير في LinkedIn. ضغطت LinkedIn نماذج المعلم الكبيرة إلى نموذج ترتيب بمعاملات 0.6B لبحث الوظائف باستخدام التقطير متعدد المعلمين، ما جعل التدريب أسرع 8 مرات عبر إطار تقديم قائم على SGLang.
علماء الرياضيات ضد OpenAI. وقّع 25 من الحاصلين على ميدالية فيلدز على رسالة يؤكدون فيها أن مختبرات الذكاء الاصطناعي تهدد العمل الرياضي؛ وتُتهم OpenAI بالضغط للحصول على الفضل، كما انسحبت من رعاية فعالية رياضيات في CalTech.
معهد سلامة الذكاء الاصطناعي الرياضي. يؤسس Jacob Tsimerman، الحاصل على ميدالية فيلدز، معهد Mathematical A.I. Safety Institute لتطوير براهين بأسلوب التشفير على سلامة الذكاء الاصطناعي، بدءًا من 10 إلى 30 رياضيًا في يناير 2027.
هذا كل شيء لليوم - قراءة حوالي 5 دقائق.