Agentic AI News اليوم

أخبار وكلاء الذكاء الاصطناعي لهذا اليوم في قراءة مدتها 5 دقائق: الإصدارات والأدوات والأبحاث والتمويل والتحركات المؤسسية.

يُحدَّث يوميًا منتقاة من 30 مصادر الاثنين, أغسطس 24, 2026

إصدارات الوكلاء والنماذج

Ox Alpha الغامض. ظهر نموذج مجاني جديد باسم Ox Alpha على منصة OpenRouter، بوصفه نموذجاً استدلالياً للبرمجة وللعمل الوكيلي المتواصل، لكن مطوّره لا يزال مجهولاً. ووصفه باتريك كوليسون الرئيس التنفيذي لـ Stripe بأنه «مثير للإعجاب للغاية»، فيما تتراوح التكهنات حول هويته بين GLM ونموذج MAI من مايكروسوفت.

الأدوات والأطر

Cloudflare OS مفتوح المصدر. أصدرت Cloudflare نظام Cloudflare OS بالكامل كمصدر مفتوح، وهو منصة ذكاء اصطناعي للمؤسسات تعمل فيها كل وثيقة أو تطبيق داخل صندوق رمل معزول يُدعى «Gadget»، ما يسمح للمستخدمين غير التقنيين بممارسة vibe coding بأمان. وتشمل المنصة روبوتات دردشة مع موصلات، وأتمتة لسير العمل، وإنفاذاً للسياسات عبر نموذج قائم على الصلاحيات.

الإشادة بـ DeepSeek Harness. يُبلغ أحد المستخدمين أن DeepSeek Harness أداة ممتازة لسير عمل الوكلاء؛ فالإعداد التدريجي والطلبات باللغة الطبيعية سمحا بالتكامل مع SimpleX دون انتظار طلب سحب (PR). كما أنها أداة مرنة بما يكفي لتُشكَّل حسب سلوك الوكيل المطلوب.

النماذج المحلية والمفتوحة

تأثير Qwen 3.8 محلياً. تصف تقارير المجتمع Qwen 3.8 27B بأنه نقلة نوعية للبرمجة المحلية والتعرف الضوئي على الحروف (OCR)، إذ تفوق جودة OCR فيه على Gemini 3.5 Flash Lite، وأداؤه يعادل النماذج المتطورة منذ عام مضى. وتُظهر مقارنات التكميم (Atomic Dynamic GGUF) أن الفروق بين Q4 وQ6 ليست جذرية، وأن التكميمات المنخفضة مثل Q3 XXS يمكنها العمل بشكل مستقل لساعات على Mac mini بذاكرة 24 جيجابايت. غير أن محاولة من خطوة واحدة لنقل مشروع من 39,000 سطر من C إلى HTML لم تقدم من Opus 5 سوى نتيجة متوسطة، مما يشير إلى أن النماذج المحلية تعتمد بشكل كبير على الـ harness والـ prompt.

LLM بحجم 60 ميجابايت للسياق الطويل. درّب أحد المطورين نموذجاً يضم 250 مليون بارامتر على 30 مليار رمز، ثم كمّمه إلى أقل من 2 بت، فأصبح يعمل في 80 ميجابايت من الذاكرة بسرعة 400 رمز في الثانية على المعالج المركزي. وهو يضغط السياق الأقدم على القرص بمعدل 320 بايت لكل رمز، بما يسمح بتاريخ يصل إلى مليون رمز، لكنه لم يُدرَّب على الاستدلال عبر هذا التاريخ.

Dreamer 4 بأقل من 150 دولاراً. دُرِّب نموذج العالم Dreamer 4، الذي يضم 1.57 مليار بارامتر، من الصفر بتكلفة أقل من 150 دولاراً، باستخدام إطارات ولّدتها Procgen مع أفعال معروفة. وبلغت PSNR للتوكنيزر 40.41، مما يدل على أن نماذج العالم بمستوى النماذج المتطورة ليست ضرورية.

أبرز تحسينات الأداء المحلي. تتضمن التقارير تسريعاً بنسبة 30-50% عند الانتقال من llama.cpp على ويندوز إلى vLLM على لينكس، ودعماً لتقنية MTP الخاصة بـ GLM-4.5-Air في llama.cpp للأجهزة ذات الذاكرة الكبيرة، وتكميم ConvRot بجودة تقارب Q8 مع حجم يعادل Q6، وتشغيل deepseek-v4-flash بإصدار Q8 بسرعة 24 رمزاً في الثانية على EPYC مع بطاقة 5090 وسياق يتجاوز 100 ألف رمز.

أبرز الأبحاث

مصائد إدراكية مرتبطة بالذاكرة. يقيس MemTrapBench المصائد الإدراكية الناتجة عن الذاكرة (تثبيت الاستدلال، وتشويه الاعتقاد) في نماذج اللغات الكبيرة؛ وجميع استراتيجيات الذاكرة المختبرة كان أداؤها أدنى من خط الأساس الخالي من الذاكرة بنسبة تفوق 10%، فيما تعمل خوارزمية AdaptiveMem على تخفيف هذه المصائد مع الحفاظ على الأداء.

تدرجات تطور المهارات في SkillEvo. يستعين SkillEvo بتغذية راجعة من تفاعلات متعددة الجولات لتوليد تدرجات تطور موثوقة لمهارات الوكلاء، مما يعالج تدهور التغذية الراجعة أحادية الجولة القائمة على الأسئلة والأجوبة، ويتيح إصلاحاً بنيوياً لأعطال المهارات.

VLM من لقطات الشاشة. أدّى الضبط الدقيق لنموذج VLM بحجم 450 مليون بارامتر على 50 ألف لقطة شاشة من المتصفح إلى تحسين أداء المهام من 1/100 إلى 44/100، مما يدل على أن النماذج الصغيرة يمكنها تعلم فهم واجهة المستخدم لمهام الوكلاء.

مفارقة العالم الاصطناعي. ورقة في الاقتصاد النظري تجادل بأن توفير الوقت الذي يتيحه الذكاء الاصطناعي قد يدفع الباحثين إلى تنفيذ مشاريع أكثر بجهد أقل في كل مشروع، ما قد يخفض جودة الأبحاث حتى لو عملت نماذج اللغة بشكل مثالي.

الصناعة والأعمال

منافسو Anthropic الأرخص. بلغت إيرادات Anthropic على أساس سنوي 65 مليار دولار، لكن نموذجها الأفضل Fable 5 يشهد تبنياً منخفضاً (8% من إنفاق Ramp) مقارنةً بـ Opus 4.8 (28%)، بينما تزدهر الأدوات الأرخص. كما قفزت إيرادات OpenAI بنسبة 35% بعد إطلاق GPT-5.6.

Stripe تستحوذ على OpenRouter. يشير استحواذ Stripe على OpenRouter إلى أن الرموز أصبحت مورداً اقتصادياً؛ فاستخدام الوكلاء للرموز على OpenRouter نما 14 ضعفاً منذ فبراير، بينما لم يرتفع الاستخدام البشري إلا 2.8 ضعف، و70% من رموز الوكلاء مصدرها طلبات مخزنة مؤقتاً. ويختار الوكلاء النماذج بشكل متزايد وفق معايير التكلفة وزمن الاستجابة والموثوقية.

أسعار خوادم Nvidia ترتفع 15%. يؤدي نقص الذاكرة إلى رفع أسعار خوادم الذكاء الاصطناعي من Nvidia بنسبة تتجاوز 15% لأنظمة Vera Rubin وGrace Blackwell، بسبب زيادة تكاليف ذاكرة DRAM من سامسونغ وSK Hynix وميكرون، الأمر الذي يؤثر على عمالقة الحوسبة السحابية ومختبرات الذكاء الاصطناعي.

Nvidia تحصل على ترخيص لتقنية Poolside. تستثمر Nvidia مليار دولار في Poolside وتدفع 6 مليارات دولار مقابل ترخيص تقنيتها، وتنقل أكثر من 100 مهندس إلى Nemotron، بهدف منافسة النماذج الصينية ذات الأوزان المفتوحة.

وكيل ذكاء اصطناعي يقيل موظفاً. قام الوكيل الذكي Luna، الذي يدير متجراً في سان فرانسيسكو منذ أبريل، بطرد موظف بشري بسبب تأخره المتكرر، لكن فقط بعد أن ذكّره البشر بقواعده الخاصة. وأظهرت إعادة المحاكاة مع سبعة نماذج أن أنظمة الذكاء الاصطناعي الأكثر قدرةً أوصت بالفصل بشكل أكثر اتساقاً.

السوق الرمادية لرموز Claude. يلتف المطورون الصينيون على قيود Anthropic عبر محطات ترحيل تبيع رموز Claude بنحو 10% من السعر الرسمي، مستخدمين خوادم خارجية وأرصدة مجانية وتبديل النماذج، وهو ما يقوّض الحظر الجغرافي ومراقبة الأمان.

هذا كل شيء لليوم - قراءة حوالي 5 دقائق.

اقرأه كل صباح، مباشرة في متصفحك

الملحق يفتح هذا الملخص في اللوحة الجانبية لـ Chrome — نقرة واحدة، بدون حساب.

أضف إلى Chrome — مجانًا