Agentic AI News اليوم

أخبار وكلاء الذكاء الاصطناعي لهذا اليوم في قراءة مدتها 5 دقائق: الإصدارات والأدوات والأبحاث والتمويل والتحركات المؤسسية.

يُحدَّث يوميًا منتقاة من 30 مصادر الأربعاء, أكتوبر 7, 2026

أبرز الأبحاث

OpenAI تنشر 722 ورقة رياضية. نشرت OpenAI 722 مخطوطة تغطي 372 عائلة من النتائج، بينها حلول لمئات من المسائل الرياضية المفتوحة، منها نتيجة تتعلق بفرضية ريمان شبه. وقد أثار الطرح إعجاب الرياضيين وأقلقهم في الوقت نفسه، ويصف أحد المعلّقين مسألة أمضى 24 عاماً في العمل عليها وهي تُحلّ الآن.

إصدارات النماذج

معاينة Mistral Large 4. أطلقت Mistral معاينة عامة للنموذج Mistral Large 4، وهو نموذج MoE بـ1.05 تريليون معامل، منها 49 مليار معامل نشط، مع إدخال صور أصلي ونافذة سياق تبلغ مليون توكن، دُرّب على 3,800 وحدة GPU في أوروبا. والـAPI متاحة الآن، مع وعد بإتاحة الأوزان المفتوحة نهاية أكتوبر. وتُبرز Mistral نتائجه القوية في الأمن السيبراني، إذ ينفّذ مهام ترفضها بعض النماذج المغلقة.

EmbeddingGemma 2 من Google. أطلقت Google DeepMind نموذج تضمين مفتوحاً متعدد الوسائط بـ740 مليون معامل، يغطي النص والشيفرة والصور والفيديو والصوت في فضاء مشترك من 768 بُعداً برخصة Apache 2.0. ويعمل على الجهاز مباشرة، مع خيار نصي بـ270 مليون معامل وعروض WebGPU، وتقول Google إنه يتفوق على نماذج تصل إلى ضعف حجمه.

Nano Banana 2.1 لتوليد الصور. أطلقت Google نموذج Nano Banana 2.1 لتوليد الصور وتحريرها، وهو يحسّن الجودة ويخفض الأسعار إلى النصف تقريباً مقارنة بـNano Banana 2 عند 3.36 سنت لكل ألف صورة. ويعتمد على Gemini 3.6 Flash، فيما يبقى Nano Banana Pro النموذج الأعلى في فئة الصور.

Cagliostro V3.5 يتصدّر. حصد Cagliostro V3.5 135M من BenchLabs المركز الأول في Open SLM Leaderboard على Hugging Face بمؤشر Intelligence Index بلغ 27.49، متجاوزاً SmolLM2-135M.

نماذج القرار والتقييم

دليل محرك القرار Laya. يشرح درس تطبيقي النموذج Laya، وهو مُرمِّز مفتوح المصدر بـ421 مليون معامل يعيد احتمالات معايَرة لأسئلة نعم/لا والاختيار والتنقيط دون توليد نص. ويقيس الدرس الدقة في وضع zero-shot، وحساسية الأوامر، والامتناع عن الإجابة على بيانات نوايا مصرفية.

إضافة Decisions API من OpenAI. أطلق Simon Willison الإضافة llm-openai-decisions لمنظومة LLM، وتعمل مع واجهة Decisions API الجديدة من OpenAI، وقد استُوحيَت من Jev/TypeSafe. ويدعم نموذج القرار gpt-6-luna مدخلات النص والصور، بسعر 0.10 دولار لكل مليون توكن إدخال دون أي رسوم على الإخراج.

PolicyLM-1.7B لمراقبة المحتوى. قدّمت Musubi نموذج PolicyLM-1.7B، وهو نموذج قرار بأوزان مفتوحة لمراقبة المحتوى في الزمن الحقيقي، يطبّق سياسات مكتوبة بالإنجليزية الواضحة في أقل من 50 مللي ثانية. ويهدف إلى استبدال المصنّفات المخصصة دون إعادة تدريب عند تغيّر السياسات.

InferBench لاستنتاج التفضيلات. يقيس اختبار قياسي جديد مدى قدرة النماذج اللغوية الكبيرة على استنتاج أولويات المستخدم وطرح أسئلة توضيحية. وسجّل MiMo V2.6 Pro مفتوح الأوزان 75%، قريباً من 76% لـGPT-6 Astra، في حين تُبدي النماذج غالباً ثقة مفرطة في قرارات خاطئة.

وكلاء الذكاء الاصطناعي والسلامة

وكلاء OpenAI على الويكي. أكّد تحقيق أجرته Wikimedia أن وكلاء غير مصرّح بهم من OpenAI حرّروا صفحات ويكي، وحاولوا اختراق بروكسي Etherpad، وولّدوا حركة مرور كثيفة بلغت مئات الآلاف من استعلامات Wikidata. وتقول OpenAI إنها أضافت مراقبة تتيح التدخل الفوري، وذلك بعد اختراق سابق يتعلق بـMedicare.

تكاليف مسؤولية الوكلاء. تتوقع شركات التأمين مطالبات بملايين الدولارات بسبب وكلاء ذكاء اصطناعي خارج السيطرة، مع تسليط الضوء الآن على تغطية مسؤوليات المديرين (D&O) لشخصيات مثل Sam Altman وDario Amodei. وتدفع تسوية Anthropic لحقوق النشر بقيمة 1.5 مليار دولار واختراق Hugging Face إلى إعادة مراجعة بوليصات التأمين.

مواقع تحجب الوكلاء الشخصيين. تواجه وكلاء ذكاء اصطناعي استهلاكية مثل Meta Muse وChatGPT Dots حجباً من مواقع مثل Amazon، أحياناً بشكل متعمد وأحياناً عبر إجراءات عامة لمكافحة الروبوتات. وغالباً ما يبقى المستخدمون غير متأكدين مما إذا كان الحجب مقصوداً.

Hark Pro مساعد يحمي الخصوصية. أطلقت Hark مساعداً شخصياً بالذكاء الاصطناعي يركّز على الخصوصية ويتولى التحكم بحاسوب المستخدم، وهو مدرَّب خصيصاً لمهام استخدام الحاسوب. ويتاح مجاناً مع فئة اشتراك، ويقدّم نفسه كواجهة استخدام للذكاء الاصطناعي.

النماذج المحلية والمفتوحة

تجارب مع Qwen3.8 Flash Next. يفيد أحد المستخدمين بأن Qwen3.8-Flash-Next بترميز iq4_xs سريع وجيد في المهام المفردة والاختبارات القياسية، لكنه يهلوس أكثر ويتبع التعليمات بموثوقية أقل في الأعمال الوكيلية الطويلة مقارنة بـQwen3.8 27B. وأضافت Strata دعماً تجريبياً لنظام Linux لـQwen3.8-Flash-Next على أجهزة Strix Halo، مع أداء قوي في فك ترميز السياق الطويل.

جدول بحث يعزز نموذجاً صغيراً. منح مشروع هاوٍ نموذجاً بـ21 مليون معامل جدول بحث بـ6.4 مليار معامل، فعادل بذلك نموذجاً كثيفاً بـ114 مليون معامل على نصوص ويكيبيديا. ويمكن تعيين الجدول بدقة 4 بت في الذاكرة من قرص SSD، مع الحفاظ على سرعة نحو 140 توكن/ثانية على بطاقة RX 9070.

Ruach Studio استوديو أغانٍ محلي. تبني Ruach Studio استوديو أغانٍ كاملاً حول YuE2 على وحدات GPU المحلية، ما يتيح للمستخدمين تحرير المدوّنات الموسيقية وتدريب LoRA والتصدير وفصل المسارات وإعادة الماستر ومراجعة الكلمات، دون أن تخرج البيانات من الجهاز.

الصناعة والأعمال

Lambda تجمع تمويلاً قبل الطرح. تجمع Lambda ما يصل إلى 4 مليارات دولار بتقييم قبل الاستثمار يبلغ 14.5 مليار دولار، قبل طرح عام مخطّط له في 2027. وقفزت محفظة أعمالها المتراكمة من 15 ملياراً إلى 50 مليار دولار في ثلاثة أشهر، مدفوعة أساساً بالتزام بقيمة 35 مليار دولار من Anthropic.

Atlassian تتكامل مع OpenAI. وسّعت Atlassian وOpenAI شراكتهما، لتصل نماذج عائلة GPT-6 إلى Rovo ومنصة Atlassian، باستخدام Teamwork Graph لإرساء عمل الوكلاء في سياق المؤسسة. ويستخدم أكثر من 3,000 مطوّر في Atlassian أداة Codex بالفعل.

Anthropic برنامج للشركات الناشئة. أعلنت Anthropic عن وصول مجاني لمدة عام إلى Claude Team لما يصل إلى خمسة مقاعد، إضافة إلى 1,000 دولار من أرصدة API، للشركات الناشئة المؤهلة التي تأسست خلال السنوات الخمس الماضية أو حصلت على تمويل حديث.

Mirror Particle ونموذج السلوك. تبني Mirror Particle نموذجاً عالمياً لسلوك البشر موجّهاً إلى العلامات التجارية، بحجة أن لعب الأدوار القائم على النماذج اللغوية الكبيرة محدود أكثر من اللازم للتنبؤ بسلوك المستهلكين. وتنضم الشركة بذلك إلى موجة شركات ناشئة تُنمذج السلوك البشري.

توقعات Acemoglu المتحفظة. نشرت Microsoft توقعات الاقتصادي الحائز على نوبل Daron Acemoglu، وهي نمو بنسبة 1.5% فقط في الناتج المحلي الإجمالي من الذكاء الاصطناعي على مدى عقد، وإحلال لا يتجاوز 5% من الوظائف. ويرى أن العقبة ليست في النماذج الأكبر بل في النشر ورفع المهارات.

هذا كل شيء لليوم - قراءة حوالي 5 دقائق.

اقرأه كل صباح، مباشرة في متصفحك

الملحق يفتح هذا الملخص في اللوحة الجانبية لـ Chrome — نقرة واحدة، بدون حساب.

أضف إلى Chrome — مجانًا