Agentic AI News اليوم

أخبار وكلاء الذكاء الاصطناعي لهذا اليوم في قراءة مدتها 5 دقائق: الإصدارات والأدوات والأبحاث والتمويل والتحركات المؤسسية.

يُحدَّث يوميًا منتقاة من 30 مصادر الأحد, أغسطس 30, 2026

إصدارات الوكلاء والنماذج

معاينة Tencent Hy4. أصدرت Tencent معاينة Hy4، وهي قفزة كبيرة في الحجم مقارنة بـ Hy3 مع تفكير عالٍ افتراضيًا ووضع no_think. ويوجد بالفعل في المجتمع نسخة كمية رسمية بمعدل ~2.38 بت وملف GGUF بحوالي 200GB يُقال إنه يحتفظ بنحو 98% من أداء BF16.

الاستدلال المحلي والأجهزة

FlashMLA على sm_120. إصدار مجتمعي يوسّع FlashMLA ليعمل على وحدات GPU الاستهلاكية من Blackwell بمعمارية sm_120، محققًا تسريعًا يتراوح بين 2 و3 أضعاف مقارنة بـ PyTorch SDPA في عدة أحمال عمل متفرقة لـ MLA، مع انخفاض زمن الوصول بنسبة 8% لفك ترميز ذاكرة التخزين المؤقت FP8.

إصلاح Nemotron لـ 16GB. كانت ملفات GGUF منخفضة الدقة لنموذج Nemotron-3.5-Lightning تبلغ ~4.70 بت فعليًا بسبب التكميم بعرض الصف؛ وبناء مُصحح من llama.cpp ينتج ملفًا حقيقيًا بمعدل 3.07 بت / 11.77 GiB يعمل بسياق 262K على ذاكرة 16GB.

Qwen3.8-Flash-Next على Mac. نموذج Qwen3.8-Flash-Next بكمية 2-bit وحجم 79GB يعمل على Mac M5 Max بذاكرة 128GB مع فتحة سياق 350K باستخدام llama.cpp، بما في ذلك prefill بارد لمدة 333 ثانية لمدخلات 105K، وفك ترميز تخميني ngram-mod.

DeepSeek V4 Flash على GPU مزدوج. على إعدادات 2× DGX Spark/GX10، يحقق DeepSeek V4 Flash 0731 معدلًا مستدامًا يتراوح بين 67 و84 رمزًا في الثانية، مع HumanEval Pass@1 محلي يبلغ 94.5% مقابل 97.0% لنموذج GLM-5.3-Flash NVFP4. وأنهى GLM المعيار في نحو نصف الوقت.

سياق 1M على 5090 مزدوج. نسخة معدلة من NInfer تضيف tensor parallelism وتوسيع YaRN بمقدار ×4 لتشغيل Qwen3.8-27B NVFP4 بسياق يبلغ 1,048,576 رمزًا على وحدتي RTX 5090، بفك ترميز بمعدل 48–100 رمزًا في الثانية عند 1M مع الحفاظ على قبول MTP بينما ينخفض vLLM إلى الصفر.

27B على 16GB. تسمح إعدادات التكميم الهجين وإعدادات kvarn cache بتشغيل Qwen3.8-27B بسياق 100K وبمعدل 50 رمزًا في الثانية على RTX 4070 Ti SUPER بذاكرة 16GB، باستخدام فك ترميز تخميني MTP وذاكرة تخزين مؤقت KV بدقة الذيل.

محرك FreeToken لـ MoE. قدّم باحثون من UC Berkeley وMIT محرك FreeToken، وهو محرك مفتوح المصدر ينسق ديناميكيًا نقل خبراء MoE، ما يتيح للنماذج المتفرقة الرائدة فك الترميز على وحدات GPU الاستهلاكية دون توقف بسبب أخطاء PCIe/RAM.

المعايير والتقييمات

Terminal Bench 4.0. صدر Terminal Bench 4.0 مع لوحة متصدرين محدثة وتركيز على التكرار السريع لمكافحة التشبع؛ وسجل GLM-5.3 نتيجة بمستوى Fable 5 ضمن هامش الخطأ.

كشف معيار التمويل. تُظهر بطاقة معيار لنموذج Ling-3.0-flash-Fin مدى تأثير بنية الوكلاء والأدوات وخطوط أنابيب التقييم في النتائج المعلنة؛ فقد استخدمت العديد من عمليات التشغيل ReAct مع البحث عبر الويب وPython، وبعض مجموعات التقييم داخلية أو غير منشورة بعد.

الأبحاث والبنية التحتية للوكلاء

ذاكرة Google WikiSkill. يمنح WikiSkill من Google Research الوكلاء قاعدة معرفية شبيهة بالويكي ودائمة للإخفاقات والنجاحات السابقة، ويتضمن مهارات Agent Skills قابلة لإعادة الاستخدام توجه السلوك دون تغيير أوزان النموذج.

معيار عتاد النماذج من Anthropic. تبني Anthropic معيار MHS، وهو واجهة موحدة تتيح للوكلاء التحكم في أجهزة مادية مثل المجاهر والأذرع الآلية؛ وقد خفضت الاختبارات المبكرة زمن التكامل بين عدة أنظمة من أسابيع إلى ساعات، لكن الإشراف البشري يظل ضروريًا.

طبقة بيانات للوكلاء. يرى عرض تقديمي من TOTVS أن الأنظمة التعاملية وبحيرات البيانات ليست محسّنة للتفكير الاستدلالي للوكلاء الذي يستهلك رموزًا بكثافة ويتطلب زمن استجابة منخفضًا، ويصف تطور الوصول إلى البيانات نحو MCP والنماذج الدلالية.

مجموعة LAION للفيديو. أصدرت LAION مجموعة BVD، وهي مجموعة بيانات مخصصة للأبحاث فقط تضم 10 ملايين ساعة من الفيديو مع 55 مليون مقطع و300 مليون صورة ثابتة، تربط بين الفيديو والصوت والنص؛ وتفوقت النماذج المدربة عليها على خطوط InternVid الأساسية بما يصل إلى 2.1 نقطة في بعض المعايير.

الصناعة والأعمال

Sony وWarner تقاضيان Anthropic. رفعت Sony Music Publishing وWarner Chappell ودور نشر أخرى دعوى قضائية ضد Anthropic، متهمة إياها بالتنزيل عبر التورنت وكشط الأعمال المحمية بحقوق النشر لتدريب Claude، ومطالبة بتعويضات تصل إلى 150,000 دولار عن كل عمل. وتقول Anthropic إنها ستدافع عن نفسها.

OpenAI تقطع علاقتها مع Cursor. تنهي OpenAI عقدها مع Cursor بعد استحواذ SpaceX على Cursor، مشيرة إلى تاريخ شركات Elon Musk في خرق العقود. وردت Anthropic بوضع نفسها كشريك أكثر موثوقية وتعهدت بمواصلة توفير الحوسبة لاستخدام Cursor لنماذج Claude.

Nvidia تتجاوز وحدات GPU. يتحول سرد أرباح Nvidia من الحصة السوقية لوحدات GPU إلى تنسيق مراكز البيانات والأنظمة المحيطة بوحدة المعالجة الرسومية، حيث بنت معدات شبكات وتنسيق متطورة مع توسع الحوسبة بالذكاء الاصطناعي إلى نطاق الجيجاواط.

هذا كل شيء لليوم - قراءة حوالي 5 دقائق.

اقرأه كل صباح، مباشرة في متصفحك

الملحق يفتح هذا الملخص في اللوحة الجانبية لـ Chrome — نقرة واحدة، بدون حساب.

أضف إلى Chrome — مجانًا