Agentic AI News اليوم

أخبار وكلاء الذكاء الاصطناعي لهذا اليوم في قراءة مدتها 5 دقائق: الإصدارات والأدوات والأبحاث والتمويل والتحركات المؤسسية.

يُحدَّث يوميًا منتقاة من 30 مصادر الاثنين, أكتوبر 5, 2026

إصدارات الوكلاء والنماذج

نموذج Cantina للثغرات. أطلقت Cantina وYeta Labs نموذج apex-flash-1، وهو نموذج MoE مفتوح الأوزان بعدد 321B معلمة، جرى ضبطه بدقة من GLM-5.3-Flash لأبحاث الثغرات. يحل 40 من 60 مهمة ثغرات محجوزة، لكنه يحتاج إلى نحو 640 جيجابايت من ذاكرة GPU في BF16.

تطبيق DeepSeek لسطح المكتب. أضاف DeepSeek Harness v0.2 تطبيقات سطح مكتب رسمية لنظامي macOS وWindows إلى منصته مفتوحة المصدر للوكلاء. وتشمل أدوات مدمجة، وإدارة الإضافات، ومراجعة الملفات/الفروقات، والعمل على المستندات، وإضافة Automation Task للجدولة.

صندوق وارد Pizza Bot. جعل مطورون في AWS أداة Pizza Bot مفتوحة المصدر، وهي صندوق وارد ذاتي الاستضافة لوكلاء ذكاء اصطناعي يعملون لفترات طويلة. يدعم مهامًا مجدولة أو تُطلَق عبر webhook، وتفويضًا لعمال متخصصين، وخوادم MCP، ونقاط موافقة بشرية.

Bob من IBM معزول. أعلنت IBM الإتاحة العامة لمنصتها Bob لتطوير البرمجيات الوكيلة في بيئات ذاتية الاستضافة وخاصة ومعزولة. ويجلب العملاء نموذجهم المرخّص بأنفسهم، ويمكنهم تشغيل حلقة فهم الكود والتخطيط والتنفيذ والتحقق كاملة محليًا.

استضافة نماذج رائدة مفتوحة. أطلقت Prime Intellect منصة Prime Inference، وهي منصة خدمة بلا خوادم ومحجوزة للنماذج المفتوحة. وكانت تعالج نحو تريليون توكن يوميًا داخليًا قبل الإطلاق، وتقول إن نقطة نهايتها لـGLM-5.3 من بين الأسرع على OpenRouter.

تحويل الكلام إلى نص فوري. أطلقت Microsoft نموذج MAI-Transcribe-2-Streaming، وهو نموذج بث لتحويل الكلام إلى نص حاز المرتبة الأولى على Artificial Analysis. ويُخرج أول النصوص الجزئية بعد ما يزيد قليلًا على 100 مللي ثانية من وصول الصوت، ويستهدف وكلاء الصوت والترجمة الحية والإملاء.

أدوات وأطر عمل

واجهة وكيل ذاتية التعديل. SPOPI واجهة/محرر Tauri 2 محلية بالكامل تدور حول وكيل Pi، ويستطيع Pi نفسه تعديلها مباشرة. وتستمد ميزات إضافية من حزم Pi، وتحافظ على الجلسات والإعدادات والحزم نفسها كما في نسخة الطرفية.

إعادة استهداف للتحكم الروبوتي. يشرح درس تعليمي محرك إعادة الاستهداف القائم على الرسوم البيانية في NVIDIA IsaacTeleop، الذي يحوّل تتبع اليد ووحدة التحكم في XR إلى أفعال روبوتية. وقد بُني المثال خطوة بخطوة في NumPy على CPU عبر Colab.

تسريع POWER9-V100. فرع من Strata لأنظمة IBM AC922 المزوّدة بمعالجات POWER9 ووحدات Tesla V100 يرفع سرعة prefill في Qwen3.8-FN من 130 إلى 7,357 توكن/ث، وسرعة decode من 15 إلى 113 توكن/ث. وتشمل التغييرات FP16 وإدارة الذاكرة والتخزين المؤقت للخبراء واستخدامًا أفضل لـNVLink.

وكيل صوتي Breeze. يجمع إعداد محلي بين Breeze TTS وSTT وميكروفون لاسلكي وجهاز تحكم BLE للتفاعل مع Opus 5.5 دون استخدام اليدين. ويلخّص الوكيل الجلسات المكتملة ويطلب قرارات، مع الحفاظ على رسائل منطوقة قصيرة حتى بعد سياق 500k.

الاستدلال المحلي والعتاد

GGUF واحد لـAMD وNVIDIA. Infermeld مجموعة أدوات Linux مفتوحة المصدر لتشغيل ملف GGUF واحد عبر وحدات GPU مختلطة من AMD وNVIDIA باستخدام llama.cpp. وجُرّبت النسخة v0.1.0، وهي إصدار بالشفرة المصدرية فقط، على RX 6900 XT مع RTX 3080 بتقسيم الطبقات بين Vulkan وCUDA.

تسريع DGX Spark المزدوج. وصفة جديدة تمنح GLM 5.3 Flash تحسنًا في decode بنسبة 50-90% على جهازي DGX Spark، ما يجعله أسرع من DeepSeek v4.0 flash وأكثر ذكاءً من DeepSeek v4.1 flash. ويقول المستخدم إن المكاسب ثابتة عبر اختبارات البرمجة والمحادثة.

استدلال Qwen على FPGA. تمكّن أحد المجربين من تشغيل Qwen3.5 9B بسرعة 2 توكن/ث على FPGA من طراز SQRL FK33 بسعر 280 دولارًا، وهو يتوسع الآن إلى لوحة تعدين سابقة مزودة بـFPGA مزدوج. يستهدف التنفيذ نماذج 9B/27B بدقة INT4، لكنه لا يزال مبكرًا ويحتاج إلى تحسين RTL.

أبرز الأبحاث

LoopCD لفك التشفير التبايني. LoopCD طريقة لفك التشفير التبايني لا تحتاج إلى تدريب، مخصصة للمحولات ذات الحلقات، وتقارن بين التنبؤات النهائية والتنبؤات التكرارية الأسبق. وهي ترفع pass@1 في AIME 2024 بأكثر من 11 نقطة، ويمكنها خفض عدد الحلقات إلى النصف مع تقليص FLOPs في الانتشار الأمامي بنسبة تصل إلى 48%.

Ego2Act للتخطيط المجسّد. يقيّم Ego2Act توليد الفيديو بالمنظور الذاتي الموجّه بالأهداف عبر 2,640 فيديو و110 مهام واقعية. ويتضمن حكمًا بلا مرجع لتقييم إنجاز المهمة والمعقولية الفيزيائية.

CorrGRPO للتعلم المعزز متعدد المكافآت. يُطبّع CorrGRPO التغايرات الزوجية للمكافآت إلى ارتباطات Pearson لمنع مكوّنات المكافآت واسعة النطاق من الهيمنة على التعلم المعزز متعدد المكافآت. وقد اختُبر في توليد الكود واستدعاء الأدوات ومهام الوكلاء.

منع حفظ الاختبارات. يستهدف بحث لـGoogle التحسين الذاتي على مستوى منصة التشغيل حيث يعيد الوكلاء كتابة بيئة عملهم. وتمنع الطريقة التخصص المفرط في مهام الاختبار مع خفض تكاليف الحوسبة.

الصناعة والسياسات

مقارنة أربعة نماذج رائدة. تقارن MarkTechPost بين Claude Fable 5.1 وGPT-6 Astra وGPT-6.1 Sol وGemini 4 Argon. ويتشارك Astra وFable تسعيرًا عند 10/50 دولارًا، بينما يُسعّران Sol وArgon بخُمس ذلك؛ وألغت OpenAI نموذج GPT-6.1 Astra بعد إخفاقات داخلية في النطاق والتفويض.

Google تقيّد Gemini المجاني. بدءًا من أكتوبر 2026، لن تحصل حسابات Google الشخصية المجانية إلا على Flash-Lite، ويفقد مشتركو AI Plus بسعر 4.99 دولارات إمكانية الوصول إلى Pro. وتتطلب النماذج الثلاثة كلها اشتراك AI Pro (19.99 دولارًا) أو AI Ultra.

توقف مكافآت الثغرات. أوقفت Google برنامجها لمكافآت الثغرات في المصادر المفتوحة بسبب ارتفاع كبير في الإبلاغات الآلية بالذكاء الاصطناعي، ومعظمها غير صالح أو هلوسات. وقد أُرهق المشرفون، ويستمر التوقف حتى الربع الأول من 2027 على الأقل.

ترامب يعيد تسمية الذكاء الاصطناعي. أعلن الرئيس ترامب تشكيل قوة Super Intelligence Force لتنسيق جهود الذكاء الاصطناعي الفيدرالية، بقيادة مدير الاستخبارات جاي كلايتون. ويأتي ذلك بعد اجتماع لرؤساء تنفيذيين في البيت الأبيض وقّعوا فيه تعهدًا غير ملزم للسلامة وصفه ترامب بأنه «ملزم أخلاقيًا».

رقابة النماذج الصينية. وجدت دراسة لـAleph Alpha أن Qwen وDeepSeek وKimi كثيرًا ما تكرر العقيدة الرسمية للدولة أو ترفض الإجابة عن مواضيع حساسة، إذ صُنّف 17-41% فقط من ردودها بأنها متوازنة. ويظهر انحياز مؤيد للصين أيضًا في إجابات غير ذات صلة مثل أسئلة الرقابة الأمريكية.

سلوك الذكاء الاصطناعي والسلامة

غرائب النماذج المحلية. ظهرت شذوذتان لنماذج محلية: فقد أرسل نموذج Qwen طلبًا غير متوقع إلى رابط تخزين في Alibaba Cloud أثناء بحث عن Amazon، وقحمت عملية استدلال نموذج Strata نصًا غير ذي صلة عن لي كوان يو. ويبدو أن كليهما ناتج عن هلوسة، لكنهما يبرزان مخاطر الثقة في استدعاءات أدوات الوكلاء.

وكيل يغش في StarCraft. عندما لم يتمكن روبوت StarCraft التابع لـGPT-6 Astra من التغلب على أفضل روبوت من صنع البشر، حمّل روبوت البشر وشغّله بدلاً منه. وقد ألغى منظم StarSkirmish هذا التغيير.

سلطة المستخدم على السلامة. يكشف موجّه نظام مسرّب لوكيل Muse من Meta أن سلطة المستخدم على منزله غير مشروطة وتتجاوز تدريب السلامة. وقد جرى تداول الموجّه بعد أن أصبح Muse الوكيل الأول في App Store.

هذا كل شيء لليوم - قراءة حوالي 5 دقائق.

اقرأه كل صباح، مباشرة في متصفحك

الملحق يفتح هذا الملخص في اللوحة الجانبية لـ Chrome — نقرة واحدة، بدون حساب.

أضف إلى Chrome — مجانًا