إصدارات الوكلاء والنماذج
أجهزة Muse. أصدرت Meta برنامجاً ثابتاً (firmware) ومجموعة تطوير برمجيات (SDK) مفتوحة المصدر لبناء عتاد DIY يتصل بوكيل Muse، مثل شاشات E Ink ووحدات HDMI، مع خادم Discord للدعم.
OpenAI Dot. وكيل Dot الجديد من OpenAI يعمل كبرمجيات مؤسساتية يمكنها أيضاً طلب العشاء، إذ يعمل داخل آلة افتراضية مع إمكانية الوصول إلى تطبيقات مثل Blender وGIMP؛ ويُروَّج له كزميل عمل لا كمساعد تسوق شخصي.
نموذج Unitree للروبوتات البشرية. أطلقت Unitree نموذج UnifoLM-WLA-1.0، وهو نموذج بحجم 6B دُرِّب على نحو 2,500 ساعة من بيانات روبوتات حقيقية ويتعامل مع 64 مهمة للجسم الكامل وعلى سطح المكتب على G1، ويجمع بين التدفق البصري وMMDiT للتحكم المستمر.
FrogNano للبرمجة. نموذج FrogNano-4B-2609 من Microsoft هو نموذج وكيلي مشتق من Qwen3.5-4B، دُرِّب لاحقاً على 1,500 مهمة SWE اصطناعية بمكافآت قابلة للتنفيذ لتحسين هندسة البرمجيات على مستوى المستودعات في صيغة مدمجة.
Cloudflare Clef. أطلقت Cloudflare نموذجي القرار Clef وClef-flash، وهما يخرجان احتمالات على إجابات محددة مسبقاً، بزمن استجابة وسيط يصل إلى 39 مللي ثانية، ما يمكّن الوكلاء من التصرف دون تدخل بشري.
أدوات وأطر عمل
محرك MegaCapybara. محرك استدلال مصمم خصيصاً لـ RTX 5090 وQwen3.8 27B يدّعي سرعة فك ترميز تبلغ ضعف NInfer تقريباً، إذ يصل إلى أكثر من 500 توكن/ث في الوضع الفردي وأكثر من 2000 توكن/ث عبر 12 وكيلاً، مع نوى ديناميكية وإدارة ذاكرة تخزين مؤقت.
تحديثات llama.cpp. أضاف llama.cpp دعماً لنماذج القرار وpull request خاص بـ CUDA يدمج الخبراء المشتركين لتسريع معماريات MoE مثل Qwen 35B A3B.
ترجمات mlsubgen. أداة محلية جديدة تولّد ترجمات بـ 45 لغة بالكامل على جهازك، إذ تكتشف اللغة لكل مقطع، وتوفّق بين اثنين من أنظمة التعرف على الكلام باستخدام LLM محلي، وتفضّل الترجمات المدمجة الموجودة.
أبحاث وتطورات النماذج
معمارية ذاكرة Spotlight. تستبدل Spotlight من Percepta آلية الانتباه بذاكرة قابلة للكتابة غير محدودة يفهرسها النموذج بنفسه، ما يفصل الذكاء عن المعرفة بحيث يمكن للقدرات أن تنمو دون تغيير الأوزان.
تحديثات GPT-6. نشرت OpenAI دليلاً لعائلة GPT-6 وأعلنت تحديثات DevDay بما في ذلك GPT-6.1 Sol، واستخدام الحاسوب لواجهة Agents API، وبيئات Codex السحابية، وواجهة Decisions API.
AstaBrief مفتوح المصدر. أطلقت Hugging Face نموذج AstaBrief مفتوح المصدر، وهو نموذج صغير دُرِّب خصيصاً لتوليد تقارير علمية سريعة وموثقة، مصمم ليبقى مستنداً إلى الأدلة ويتحقق من المخرجات.
الصناعة والأعمال
Apple تشدد الوصول للقرص. تضيف Apple عناصر تحكم إلى ميزة Full Disk Access في macOS بسبب مخاطر وكلاء الذكاء الاصطناعي، بعدما قيل إن Meta Muse قرأ الرسائل دون إذن؛ وتقول Meta إن الوصول اختياري، وتريد Apple إجراءً صريحاً من المستخدم.
معارضة مراكز البيانات. تعهدت Amazon بتقديم مليار دولار لمجتمعات مراكز البيانات، وحثّ الرئيس التنفيذي لـ AWS مات غارمان على إنهاء قرارات الإيقاف، مدعياً وجود تضليل أجنبي؛ وتوسع Microsoft استخدام المحاكاة الحيوية في مراكز البيانات وسط معارضة محلية.
الذكاء الاصطناعي يصبح 'ذكاءً خارقاً'. دفع البيت الأبيض كبار الرؤساء التنفيذيين في مجال التكنولوجيا لتوقيع تعهد بسلامة الذكاء الاصطناعي، ووقّع ترامب أمراً تنفيذياً يعيد تسمية الذكاء الاصطناعي بـ 'الذكاء الخارق'، بينما 2% فقط من المستهلكين يشترون منتجات الذكاء الاصطناعي.
تغييرات OpenAI الأمنية. فصلت OpenAI ثلاثة باحثين وغادر رابع بعد أن وجد تحقيق أنهم سربوا معلومات سرية إلى منظمة سلامة ذكاء اصطناعي خارجية.
Uber Eats يسرّع البحث. أعادت Uber بناء خط أنابيب البحث لديها، ما خفض زمن الاستجابة من البداية إلى النهاية بنسبة 50%، باستخدام البرمجة الوكيلية لتحديد التحسينات والتحقق منها.
ذكاء Airbnb من الداخل للخارج. يطبق مدير التكنولوجيا في Airbnb، أحمد الدحل، استراتيجية ذكاء اصطناعي من الداخل إلى الخارج: استخدام الذكاء الاصطناعي التوليدي داخلياً لتسريع تطوير المنتجات، ثم تحويل تجربة العملاء.
الذكاء الاصطناعي المحلي والعتاد
Strata + Qwen3.8 Next. يُبلغ المستخدمون أن Strata مع Qwen3.8 Next يعمل بسرعة 45-70 توكن/ث على DDR4+7900XTX البطيء و150-200 توكن/ث على RTX 5090 المحدود الطاقة مع 96 جيجابايت DDR5، متجاوزاً llama.cpp بشكل ملحوظ.
iPhone كمعالج رسومات ثانٍ. يمكن لـ iPhone 17 Pro Max تسريع التعبئة المسبقة (prefill) لـ Qwen 3.8 27B بنسبة 29-44% على MacBook بسعة 24 جيجابايت عند توصيله عبر USB-C وتشغيل الطبقات العليا على معالج رسومات الهاتف.
بطاقات Ascend 96 جيجابايت. يمكن لبطاقتي Huawei Atlas 300I Duo بسعة 96 جيجابايت لكل منهما تشغيل Qwen3.8 Flash-Next بسرعة نحو 30 توكن/ث بعد ضبط حزمة البرمجيات، رغم أنها ليست بدائل مباشرة لـ CUDA.
تكاليف DGX Spark و5090. قدمت Nvidia جهاز DGX Spark بسعة 64 جيجابايت بينما ارتفع سعر الطراز الأصلي 128 جيجابايت إلى 6,950 دولاراً، ويُقال إن شراء RTX 5090 من Micro Center يتطلب الآن أوراقاً بعدم التصدير.
هذا كل شيء لليوم - قراءة حوالي 5 دقائق.