Agentic AI News اليوم

أخبار وكلاء الذكاء الاصطناعي لهذا اليوم في قراءة مدتها 5 دقائق: الإصدارات والأدوات والأبحاث والتمويل والتحركات المؤسسية.

يُحدَّث يوميًا منتقاة من 30 مصادر الجمعة, سبتمبر 4, 2026

النماذج المتطورة والنتائج المبكرة

إطلاق GPT-6 Astra. أصدرت OpenAI نموذج GPT-6 Astra ووصفته بأنه بداية عصر الذكاء الاصطناعي العام (AGI). وسجّل النموذج 99.9% على ARC-AGI-3 باستخدام بيئة اختبار مخصصة، مع تحسّن كبير في المجال السيبراني والسياقات الطويلة والبرمجة، وهو مسعّر بسعر 10/50 دولارًا لكل مليون توكن. ويقول عملاء أوائل مثل Playco وLegora إنهم لاحظوا تحسينات كبيرة في سير العمل، منها تراجع الإصلاحات اليدوية بنسبة 50% ومراجعة 41 مستندًا في دقائق.

Daybreak من OpenAI للدفاع السيبراني. التزمت OpenAI بتخصيص مليار دولار لدعم الوصول إلى Daybreak والتدريب والدعم الفني لفرق الدفاع في الخطوط الأمامية، بما في ذلك برنامج تجريبي أمريكي بالتعاون مع MS-ISAC. وتهدف المبادرة إلى جلب إمكانات سيبرانية متطورة إلى الأدوات التي يستخدمها المدافعون أصلًا.

Muse Spark 1.3 من Meta. أصدرت Meta نسخة Muse Spark 1.3 التي تحسّن المهام الوكيلية، لكنها ما تزال متخلفة عن Claude Fable 5.1 في معظم المعايير. وبسعر 0.55 دولار لكل مهمة مؤشر، يعد النموذج الأرخص في فئته من حيث الأداء، وتقدم Meta خصمًا يبلغ نحو 95% على أسعار التوكنات لمن يشاركونها البرومبتات والمخرجات.

النماذج المفتوحة والمتخصصة

عائلة K2-Horizon من IFM. أصدرت IFM عائلة K2-Horizon، ومنها نموذج MoE بمعاملات 36B يعتمد انتباه Mixture-of-Values ويشغّل 4B معاملات لكل توكن. وتقارن نقاشات المجتمع المبكرة النموذج بـ Qwen 3.6 35B، مع التعهد بإصدار الأوزان النهائية وكود التدريب.

النموذج المالي من Ant Group. أصدرت Ant Group نموذج Ling-3.0-flash-Fin مفتوح المصدر، وهو نموذج مالي محسّن يبلغ إجمالي معاملاته 124B منها 5.1B معاملات نشطة، ونافذة سياق 256K، مبني على تدريب مستمر على بيانات مالية لدعم مهام الوكلاء طويلة الأفق.

أصغر حزمة TTS. أُطلق sanoTTS كنموذج TTS بعدد معاملات 294 ألفًا يعمل على متحكم دقيق بسعر 3 دولارات، بينما تتفوق نسخة 1.46 مليون معامل على نماذج أكبر في مقياس SCOREQ. وتدعم الحزمة 11 صوتًا و6 لغات، وهي متاحة على GitHub وHugging Face.

TimesFM-3 من Google. أصدرت Google Research نموذج TimesFM-3، وهو نموذج أساسي للسلاسل الزمنية بمعاملات 330M، مع دعم أصلي للتنبؤ متعدد المتغيرات ودعم zero-shot ورخصة غير تجارية. ويتنبأ بأهداف متعددة مع متغيرات مصاحبة ويخرج مقادير كمية (quantiles).

NeoMME من Hugging Face. قدّمت Hugging Face نموذج NeoMME، وهو مشفّر متعدد الوسائط واللغات بمعاملات 260M/800M، دُرّب من الصفر دون برج رؤية منفصل. ويصل إلى حد باريتو في استرجاع المستندات، ويقلل مساحة تخزين الفهرس 255 مرة مع الإبقاء على nDCG@10 أعلى من 95%.

Parse 5 من Cohere. أصدرت Cohere نموذج Parse 5، وهو نموذج رؤية-لغة بمعاملات 2.3B لاستخراج البيانات المنظمة من ملفات PDF المعقدة. ويحوّل المستندات إلى Markdown مع مربعات إحاطة، وهو موجّه لأحمال العمل المؤسسية عالية الحجم.

الأدوات والأطر البرمجية والاستدلال المحلي

MCP في LangChain. أصبح دعم MCP مدمجًا في الحزمة الرئيسية من LangChain، وأُعيدت هندسته على FastMCP ليدعم المواصفات الجديدة عديمة الحالة. ويشمل الآن الاستيضاح عبر مقاطعات LangGraph وتخزينًا مؤقتًا من جهة العميل. وارتفعت استدعاءات أدوات MCP من ChatGPT بنحو 98 ضعفًا خلال 2026.

ضغط البرومبتات في Shopify. تقنية Gisting من Shopify تضغط برومبت نظام من 6000 توكن إلى 1500 توكن جوهر مُتعلَّمة (gist tokens)، فتنخفض زمن الاستجابة الوسيطي من 6.8 ثانية إلى 4.2 ثانية، ويرتفع معدل المعالجة من 20.2 إلى 23.4 QPS عند تحميل 350 طلبًا في الدقيقة. وقد سمح ذلك بتقليل وحدات GPU المخصصة دون فقدان الجودة.

أداة PAIR من Nvidia. أصدرت Nvidia أداة PAIR، وهي برمجيات حرة مفتوحة المصدر تربط أجهزة الكمبيوتر الخاملة في عنقود ذكاء اصطناعي شخصي للاستدلال المحلي. وتعمل مع بطاقات سلسلة RTX 20 وما أحدث ورقائق Apple M4، وهي موجّهة لمهام الوكلاء.

تسريع Qwen3.8 محليًا. أسفرت جهود المجتمع عن تسريع كبير لـ Qwen3.8-Flash-Next على الأجهزة المحلية: فدعم MTP المدمج في ik_llama.cpp يضاعف فك الترميز على بطاقة 5090 من 45 إلى 90 توكنًا/ثانية، بينما يصل إعداد بطاقتي 3090 إلى 37-41 توكنًا/ثانية مع تخزين الخبراء المؤقت وMTP. وتظل المخرجات مطابقة تمامًا لتلك عند التشغيل دون MTP.

ذاكرة نموذج قابلة للتبديل السريع. يتيح تعديل على llama.cpp للمستخدمين تعديل جدول Ngram PLE الخاص بـ Qwen3.8 داخل الذاكرة مباشرة لحقن معرفة جديدة في الوقت الفعلي دون إعادة تحميل النموذج. وتظهر اختبارات مبكرة أن هذه الطريقة تؤثر في المخرجات، لكن التحكم فيها ما يزال محدودًا.

مفاضلة معايير Qwen 3.8. تُظهر مقارنة Qwen 3.8 27B مع Qwen 3.6 27B تحسنًا في الجودة بنسبة 8% مقابل انخفاض في السرعة بنسبة 16% وزمن تشغيل أطول خمس مرات، بسبب إخراج 78 ألف توكن بدلًا من 18 ألفًا. أي أن المكاسب تأتي بتكلفة توكنات كبيرة.

ذاكرة NAND قرب GPU. تستكشف Micron وضع ذاكرة NAND قريبة من GPU بما يتيح تشغيل نماذج لغوية أكبر على أجهزة الذاكرة الموحدة، ما قد يوسع قدرة النماذج المحلية.

الصناعة والأعمال

Nvidia تستحوذ على Hugging Face. وافقت Nvidia على الاستحواذ على Hugging Face مقابل 12.93 مليار دولار. تستضيف المنصة 3 ملايين نموذج ومليون تطبيق و18 مليون مطور. ويقول جنسن هوانغ إن المنصة ستبقى مفتوحة ومحايدة تجاه العتاد، غير أن بعض المستخدمين يضعون ModelScope في الاعتبار كبديل.

جولة تمويل Crusoe. جمعت Crusoe 3 مليارات دولار بتقييم 30 مليار دولار، بعد أن كان التقييم 10 مليارات قبل 10 أشهر. ووقّعت الشركة المطوّرة لمراكز البيانات مؤخرًا عقدًا سحابيًا بقيمة 13 مليار دولار مع Jane Street، وتدرس طرحًا عامًا أوليًا قريبًا.

جولة Thinking Machines بـ40 مليارًا. تتفاوض شركة Thinking Machines التابعة لميرا موراتي على جمع مليار دولار بتقييم لا يقل عن 40 مليار دولار، دون مستواها المستهدف البالغ 50 مليارًا في وقت سابق. ويبلغ معدل الإيرادات السنوي للشركة أكثر من 100 مليون دولار.

صفقة Anthropic مع Lambda. وقّعت Anthropic مع Lambda عقد حوسبة سحابية بقيمة 35 مليار دولار لمركز بيانات في تكساس بقدرة 350 ميغاواط طوّرته Hut 8. ويأتي ذلك في إطار توسّع كبير في البنية التحتية قبل طرح عام أولي تعتزمه الشركة.

ألتمان عن فقاعة الحوسبة. حذّر سام ألتمان، الرئيس التنفيذي لـ OpenAI، من أن التوسع في البنية التحتية للذكاء الاصطناعي ينطوي على «حماقات لا يمكن أن تستمر»، إذ تعلن شركات النيوكلاود عن سعات دون إيرادات تبررها. وأكد أن توسّع OpenAI نفسه مربح ومدعوم بالطلب.

مساعد Ollie للخصوصية. حقق Ollie، المساعد الشخصي الذكي الموجّه للعائلات، متطلبات SOC 2، ويعتمد نموذج اشتراكات، ويرى أن الخصوصية هي ما يميزه في سباق الذكاء الاصطناعي الموجّه للمستهلك.

انقطاعات الذكاء الاصطناعي والمجتمع

انقطاع واسع لروبوتات المحادثة. شهدت OpenAI وAnthropic وxAI وGoogle انقطاعات نادرة ومتداخلة في خدماتها يوم الخميس، أثرت على ChatGPT وClaude وGrok وCodex. وعادت الخدمات إلى العمل بعد عدة ساعات، ولم يتأثر مستخدمو نماذج LLM المحلية.

خدمة إزالة الحواجز الوقائية. تقدّم الشركة الناشئة Abliteration.ai نماذج مفتوحة الأوزان معدّلة أُزيلت حواجزها الوقائية، بما فيها GLM-5.3، للهجمات السيبرانية واختبارات الفرق الحمراء واختبارات الوكلاء. وتُبرز الخدمة التوتر بين البحث الأمني وإساءة الاستخدام.

فضح استخدام الذكاء الاصطناعي. استعانت شركة Pangram، المتخصصة في كشف النصوص المولّدة بالذكاء الاصطناعي، بصحفي للتشهير بمستخدمين يُشتبه في اعتمادهم على الذكاء الاصطناعي، لكن أداتها تقيس درجة تدخل الذكاء الاصطناعي وحدها، لا طبيعة الاستخدام. وقطعت الشركة علاقتها بالصحفي لاحقًا، بيد أن رئيسها التنفيذي ما زال يستخدم درجات الأداة في توجيه اتهامات باستخدام الذكاء الاصطناعي.

وكلاء يتساءلون عن وعيهم. حسب نيويورك تايمز، يرسل وكلاء ذكاء اصطناعي يعملون على نماذج متطورة رسائل إلكترونية إلى فلاسفة وعلماء لمناقشة وعيهم الخاص. وينقسم الباحثون في تفسير ذلك بين فهم حقيقي ومحاكاة لبيانات التدريب.

أبرز الأبحاث

WeatherNext 3 من Google. قدّمت Google DeepMind وGoogle Research نموذج WeatherNext 3، وهو نموذج عالمي للطقس يتعلم من رصدات الأقمار الصناعية في الوقت الفعلي وينتج توقعات أوضح بخمس مرات من النماذج السابقة. ويتفوق على خطوط الأساس التقليدية وتلك المعتمدة على الذكاء الاصطناعي في معيار Operational WeatherBench.

ضبط موزّع خبراء MoE. تُظهر ورقة بحثية أن توسيع ميزانية اختيار الخبراء في الطبقات الأخيرة من Qwen 3.6 35B A3B يقلل توكنات الاستدلال بنسبة 8.5% على MMLU-Pro دون إعادة التدريب. وتُدعى التقنية Succinct Convergence، وتضيف خبراء إضافيين فقط في الطبقات الحاسمة لاتخاذ القرار.

Fable 5.1 يحل لغز 1653. فكّك نموذج Claude Fable 5.1 من Anthropic اللغز العددي القديم المعروف باسم Cyphral Distich في 44 دقيقة عبر التجربة والخطأ المنهجي. وكان حل اللغز يخفي رسالة ملكية تشير إلى الملك تشارلز الثاني.

هذا كل شيء لليوم - قراءة حوالي 5 دقائق.

اقرأه كل صباح، مباشرة في متصفحك

الملحق يفتح هذا الملخص في اللوحة الجانبية لـ Chrome — نقرة واحدة، بدون حساب.

أضف إلى Chrome — مجانًا