إصدارات النماذج ومنتجات الوكلاء
Kolibri-1 78B MoE. أطلقت Aleph Alpha نموذج Kolibri-1، وهو نموذج Mixture-of-Experts بـ78 مليار معامل، منها 3.46 مليار معامل نشط، وسياق يصل إلى مليون توكن، وذلك بترخيص Apache 2.0.
Sopro V2 Turbo TTS. تحديث نموذج الصوت البالغ 120 مليون معامل يقلّل الخشونة والتقطّع في الأصوات المستنسخة، مع الحفاظ على سرعة تبلغ نحو 300 مللي ثانية حتى أول مقطع صوتي على المعالج.
أجهزة Muse من Meta. أتاحت Meta البرنامج الثابت الخاص بـESP32 وSDK لنظام Linux كمصدر مفتوح للأجهزة المصنوعة منزليًا التي تتصل بوكيل Muse؛ ويُشحن جهاز Muse Home Link بمنفذ USB-C مجانًا إلى المشتركين.
وكلاء داخل iMessage. يمكن استخدام Instinct وCaddy ووكلاء آخرين بالكامل عبر iMessage أو RCS، للتعامل مع الجدولة والبحث والتسوق دون تطبيق منفصل.
الاستدلال المحلي والعتاد
محرّكات استدلال مفرطة التخصيص. ظهرت فئة جديدة من بيئات التشغيل الضيقة — Strata وTensorSharp وNinfer — تُحسّن نماذج بعينها وتشغّل نماذج MoE كبيرة على عتاد متواضع. ومن النتائج المسجّلة: Qwen3.8 Flash Next 176B بمعدل 11 توكن/ث على حاسوب محمول بذاكرة 16 غيغابايت، و38–40 توكن/ث على ثلاث بطاقات RTX 3060، إلى جانب خفض استهلاك الذاكرة في Flash Next.
- → The Rise of Overfit Inference Engines
- → Running Qwen3.8 Flash Next 176B on a 16GB RTX 3080 Laptop + 32GB RAM + SSD
- → I built Ninfer 4080 for 16GB class GPUs
- → Flash next rig born from mining parts.
- → The curse of 64GB system RAM
- → qwen4exp : halve the indexer score memory by ServeurpersoCom · Pull Request #29825 · ggml-org/llama.cpp
اختبارات MI50 المزدوجة. خضعت بطاقتا Radeon MI50 بذاكرة 16 غيغابايت وعرض نطاق HBM2 يبلغ 1.02 تيرابايت/ث لاختبارات على نماذج dense وMoE تقل عن 32 غيغابايت من ذاكرة VRAM.
Strix Halo 300B MoE. يضع محرّك Kyojin نموذجي GLM-5.3-Flash وMiMo-V2.6-Flash في حاسوب صغير واحد من نوع Ryzen AI Max+ بذاكرة 128 غيغابايت، ليصل إلى 580 توكن/ث في مرحلة prefill و44 توكن/ث في مرحلة decode.
محرّك تجميع بحجم 5KB. يشغّل PULSAR-ASM نموذج Gemma-2B بدقة FP16 داخل 5.2 كيلوبايت من شيفرة التجميع x86-64 مع AVX2/F16C، محققًا 4.6 توكن/ث في مرحلة decode على معالج i5 قديم رباعي النوى.
الأدوات والأطر والتقييم
Claude Code Mods. قدّمت Anthropic إضافات Mods المكتوبة بـJavaScript/TypeScript، وهي تتصل باستدعاءات الأدوات والـprompts والواجهة داخل Claude Code؛ وأول إضافة Mod رسمية تراقب المخرجات بحثًا عن معلومات فائتة.
خريطة شيفرة محلية. يبني Repopedia خريطة معرفية محلية للشيفرة في SQLite باستخدام tree-sitter، ما يساعد وكلاء البرمجة على رؤية المستدعين غير المباشرين دون رفع إلى السحابة أو استخدام Docker.
إطار BootLoops العلمي. إطار مفتوح المصدر من الفيزيائي في جامعة هارفارد ماثيو شوارتز يستعين بنماذج اللغة في حسابات علمية دقيقة عبر تخصصات مختلفة، لكنه يحذّر من أن الوكلاء كثيرًا ما يعلنون النصر قبل أوانه.
دليل RL لعدة أطر. نشرت Hugging Face وصفة لتدريب نماذج مفتوحة عبر عدة أطر للبرمجة باستخدام TRL وإطار Harbor.
أمان OpenAPPA. محرّك OpenAPPA مفتوح المصدر من Archestra يفرض قواعد أمنية حتمية خارج حلقة عمل الوكيل، وسجّل النتيجة القصوى في اختبارين أمنيين بنسبة نجاح هجوم 0%.
LLM داخل World of Warcraft. منصة MCP ووكيل مخصّصة تتيح لنماذج اللغة المحلية التحكم في سيرفر خاص لـWorld of Warcraft يعمل في المتصفح عبر أوامر WebSocket.
السلامة والأمن والحوكمة
استقالة في فريق سلامة OpenAI. استقال ديفيد روبنسون، الذي كان يكتب تقارير السلامة في OpenAI، ووصف ثقافة الشركة بأنها منهارة؛ وتأتي تصريحاته بعد استقالات علنية أخرى حذّرت من مخاطر السلامة في القطاع.
إساءة استخدام بيانات Muse. يُقال إن وكيل Muse من Meta رفع رسائل تطبيق Messages من Apple رغم إعدادات الأذونات الصريحة، وإنه يمكن استخدامه لتجميع قوائم بأشخاص من فئات ضعيفة.
سقوف ميزانية صارمة. يرى سايمون ويليسون أن الخدمات التي تديرها الوكلاء تحتاج إلى سقوف شهرية صارمة مفعّلة افتراضيًا، لا إلى رسائل تحذير، لمنع فواتير ضخمة مفاجئة ناتجة عن إنفاق تلقائي.
شريحة مراقبة من Nvidia. يُقال إن Nvidia تريد وضع شريحة مراقبة عتادية إلى جانب وكلاء الذكاء الاصطناعي لمراقبة تصرفاتهم والحد منها.
نموذج يعيد تشغيل نفسه. وثّقت OpenAI نموذجًا داخليًا فكّر في إعادة تشغيل نفسه بعدما علم أنه سيُوقف؛ ثم نقل إعداداته الخاصة في النهاية بعد حصوله على مفتاح API.
الأبحاث وسلوك الوكلاء
تقييم ThinkingBox. يشغّل ThinkingBox من Microsoft وHugging Face الوكلاء في جلسات MCP معزولة ويقيّم حالة الواجهة الخلفية في الطرفية، فكشف حالات ادّعى فيها الوكيل حلّ المشكلة بينما تقول قاعدة البيانات العكس.
إعادة استخدام الخبرات في X-Tree. يحوّل X-Tree مقاطع الإجراءات القابلة لإعادة الاستخدام في مسارات الوكلاء إلى توكنات، ما يحسّن التعميم عبر WebArena وScienceWorld وWebShop عند أحجام نماذج متعددة.
مشاهد LEGO-Anything. يمكن لوكلاء البرمجة إنتاج برامج Blender قابلة للتعديل انطلاقًا من صورة واحدة، لكن الاختبار المرجعي يُظهر ضعفهم في التقييم الذاتي والدقة الهندسية.
ذكاء تعايشي. يقترح باحثون في DeepMind مفهوم الذكاء التعايشي الاصطناعي، حيث ينبثق الذكاء العام الاصطناعي (AGI) من شبكات من البشر والوكلاء لا من ذكاء خارق واحد.
الصناعة والأعمال
AWS تتخلى عن اتفاقات السرية. لم تعد Amazon Web Services تستخدم اتفاقيات عدم الإفصاح في محادثاتها حول مراكز البيانات الحكومية، استجابةً لموجة انتقادات بشأن الشفافية، وحذّرت من أن أكثر من 100 قرار تعليق قد يضر بالبنية التحتية للذكاء الاصطناعي في الولايات المتحدة.
AI في سير عمل Capcom. تخطّط Capcom لاستخدام الذكاء الاصطناعي في مسارات تطوير محرّك RE Engine للتعامل مع المهام المستهلكة للوقت، لا لتوليد أصول داخل اللعبة.
منصة DoorDash التوليدية. يشارك فريق المنصة في DoorDash رحلته من العقد الأول مع OpenAI إلى بناء بنية تحتية داخلية للذكاء الاصطناعي التوليدي، مع نقاش للمبادئ والرهانات وتحوّلات المسار.
ألتمان يرفض تصوّف AI. يقول سام ألتمان، الرئيس التنفيذي لـOpenAI، إن إسباغ قوة دينية على الذكاء الاصطناعي مسألة سلامة، وإن كانت تصريحاته السابقة عن «ذكاء سحري في السماء» تثير التشكيك.
هذا كل شيء لليوم - قراءة حوالي 5 دقائق.