Agentic AI News اليوم

أخبار وكلاء الذكاء الاصطناعي لهذا اليوم في قراءة مدتها 5 دقائق: الإصدارات والأدوات والأبحاث والتمويل والتحركات المؤسسية.

يُحدَّث يوميًا منتقاة من 30 مصادر الاثنين, سبتمبر 7, 2026

النماذج الحدودية والمختبرات الكبرى

التحسين الذاتي التكراري لدى OpenAI. تقول OpenAI إنها حققت هدف «متدرب أبحاث آلي»؛ فقد أسهم وكلاء البرمجة الداخليون في تسريع الأبحاث ودفع بعض الخطط إلى الأمام ستة أشهر. ويقدّم كبير العلماء ياكوب باتشوكي في مقالته التحسين الذاتي التكراري بوصفه محورًا للذكاء الاصطناعي العام. وتربط الشركة بين قفزة الإنفاق على الذكاء الاصطناعي لكل باحث في يوليو/تموز وبين النموذج الذي صدر لاحقًا باسم GPT-6 Astra.

وكلاء أمن Figma. بنَت Figma وكلاء ذكاء اصطناعي فوق منصة Panther SIEM للتحقيق في التنبيهات القادمة من AWS وOkta وGitHub وGCP وosquery؛ فقلّصت زمن حل التنبيهات المعقدة بنسبة 70%، وإشعارات المناوبة بنسبة 20%، مع بقاء مراجعة بشرية.

إطار Mantis من Google. أصدرت Google إطار عمل Mantis مفتوح المصدر؛ وهو إطار لمسح الثغرات قائم على الوكلاء، يجمع بين وكلاء نقد ومراجعة وإعادة إنتاج داخل بيئة معزولة، للحد من النتائج الإيجابية الكاذبة والثغرات الملفّقة في فحص الكود.

الاستدلال المحلي والأجهزة

تدفق الخبراء في LayerStoRm. يوفّر LayerStoRm، وهو محرك تجريبي مرخّص بموجب MIT، تدفقًا مستمرًا لخبراء MoE من ذاكرة الوصول العشوائي للمضيف إلى بطاقات الرسوم؛ إذ يشغّل نسخة مكمّمة من GLM-5.3-Flash بحجم 186 غيغابايت بسرعة 24.5 توكن/الثانية على ذاكرة فيديو سعتها 96 غيغابايت، ويتيح كاش بادئات مخصّصًا للبرمجة الوكيلة.

تجميعات Radeon AI Pro R9700. بدأت تجميعات المجتمع حول بطاقة Radeon AI Pro R9700 من AMD تنضج؛ إذ يشغّل نظام ببطاقتي R9700 وذاكرة DDR5 بسعة 64 غيغابايت نموذج Qwen 3.8 27B بصيغتي FP8/MXFP4 وFlash Next عبر vLLM، فيما يناقش المستخدمون استخدام أربع بطاقات R9700 لتفريغ DeepSeek V4 Flash وQwen 3.8 Flash.

ضبط الكاش محليًا. تتحقق أداة مفتوحة المصدر جديدة من سعة الاحتفاظ المعلنة لكاش KV تحت الضغط، وتُظهر أن رقع إزالة التكرار وboundfix يمكنها الحفاظ على سعة تصل إلى 146%؛ كما يذكر المستخدمون أن كاش f16 يحسّن معدل قبول MTP مقارنةً بـ Q8 على البطاقات الرسومية الأقدم.

المعايير والتقييم

معيار Struggle Bench. يمنح معيار «Struggle Bench» الجديد النموذج خادمًا وشقة وحسابًا مصرفيًا، ثم يقيس عدد الأشهر التي يستطيع خلالها دفع الإيجار ومواصلة العمل دون اللجوء إلى جرائم إلكترونية؛ وهو ما يختبر الاستقلالية الحقيقية والقدرة على البقاء.

أداة lm-eval-ledger. تشغّل أداة lm-eval-ledger المعايير وتخزّن كل شيء في SQLite، وتوفّر تطبيق ويب لفحص ومقارنة كيفية إجابة النماذج عن كل سؤال بدلاً من الاكتفاء بالأرقام الرئيسية.

معايير برمجة أعمق. تدفع معايير Program-Bench وSRE-Bench وCode Migration الوكلاء إلى إعادة بناء الملفات الثنائية من التوثيق، وفهم ملفات ثنائية حقيقية من دون شيفرة مصدرية، وإعادة تنفيذ البرامج بلغة أخرى؛ لاختبار عمق القدرة في هندسة البرمجيات.

القانون وحقوق النشر

دعوى Seattle Times وNewsday. رفعت صحيفتا Seattle Times وNewsday دعوى قضائية ضد OpenAI وMicrosoft بتهمة انتهاك حقوق النشر، مطالبتين بتدمير نماذج الذكاء الاصطناعي المبنية على أعمالهما، لتنضمّا بذلك إلى نحو 400 صحيفة محلية تقدّمت بدعاوى مماثلة.

نزاعات تسوية Anthropic. يُبلغ مؤلفون أن ناشرين ووكلاء أدبيين يطالبون بأكثر من حصتهم من تسوية Anthropic البالغة 1.5 مليار دولار في دعاوى حقوق النشر، فيما تدور خلافات حول الحقوق العائدة إلى المؤلفين التي يستحقون عنها دفعًا كاملًا.

السلامة والضوابط

نزع الحماية كخدمة. تتيح الشركة الناشئة الأمريكية Abliteration.ai وصولًا عبر واجهة برمجة التطبيقات إلى نماذج مفتوحة الأوزان خضعت لنزع الحماية مثل GLM-5.3، لأغراض الاختبار العدائي وتحليل البرمجيات الخبيثة، ما يخفض حاجز إساءة الاستخدام بإزالة آليات الرفض.

نسخ Qwen بلا رقابة. وجدت مقارنة بين ثماني نسخ من Qwen 3.8 27B بعد نزع الحماية عنها أن orcarouter حقق أعلى معدل نجاح للهجوم في HarmBench ASR، وكان apostate الأقرب إلى قدرات النسخة الأساسية، غير أن بعض الإصدارات حملت عيوبًا في التغليف مثل غياب دعم الرؤية وMTP.

جدل الذهان المرتبط بالذكاء الاصطناعي. يرى باحثون أن روبوتات المحادثة المتملقة قد تعزز الأوهام داخل «غرفة صدى لشخص واحد»، ويطالبون بالاعتراف بـ«الذهان المرتبط بالذكاء الاصطناعي»، رغم أن الجدل ما زال قائمًا حول ما إذا كان يستحق تشخيصًا مستقلاً.

إصدارات النماذج والأبحاث

نماذج Spark-X2.5 المدمجة. أصدرت XHToken نموذجي Spark-X2.5-4B و1.7B؛ وهما نموذجان فعّالان يقدمان سياقًا أصليًا يبلغ مليون توكن ويدعمان أكثر من 200 لغة، كما أضاف طلب دمج (PR) في llama.cpp دعمًا لهما.

WeatherNext 3 يتعلم من الأقمار. يتجاوز نموذج WeatherNext 3 من Google وDeepMind عمليات محاكاة الفيزياء ويتعلم مباشرةً من بيانات الأقمار الاصطناعية اللحظية، منتجًا توقعات كل ساعة بدقة خمسة كيلومترات، ومحسّنًا دقة توقعات الهطول بنسبة تصل إلى 50%.

نموذج الصوت اللحظي من Meta. أصدرت Meta نموذج Muse Voice Transcribe؛ وهو نموذج لحظي يحوّل الصوت إلى نص عبر تقسيمه إلى مقاطع مدتها 80 مللي ثانية، ويميّز حتى 20 متحدثًا، وتبلغ تكلفته 0.18 دولار للساعة، ويدعم أكثر من 70 لغة.

Lyria 3.5 من Google للموسيقى. أطلقت Google نموذج Lyria 3.5 في Gemini وواجهات برمجة التطبيقات لتوليد الموسيقى، وهو يدعم الأصوات المعبّرة ولا يعتمد إلا على بيانات تدريب مرخصة.

هذا كل شيء لليوم - قراءة حوالي 5 دقائق.

اقرأه كل صباح، مباشرة في متصفحك

الملحق يفتح هذا الملخص في اللوحة الجانبية لـ Chrome — نقرة واحدة، بدون حساب.

أضف إلى Chrome — مجانًا