النماذج المحلية وسير عمل الوكلاء
تفوّق Qwen3.8-27B منخفض التكميم. يكتشف المستخدمون أن Qwen3.8-27B يظل قويًا في البرمجة بالوكلاء حتى مع إعدادي Q3_xxs وQ6؛ وتعطي إعدادات الاستدلال المنخفضة والمتوسطة درجات عالية وتقلل الحلقات، بينما يمنع preserve_thinking تكرار الاستدلال.
جحيم ذاكرة 16GB VRAM. نظام Windows بذاكرة 16GB يشغّل Qwen3.8-27B مع تعطيل MTP وذاكرة تخزين مؤقت مكمّمة وسياق يبلغ نحو 100 ألف رمز، عبر تفريغ وحدة الرؤية إلى RAM.
استدلال محلي أسرع. يصل vLLM على بطاقتي RTX 3090 إلى 143 رمزًا في الثانية مع Qwen3.8-27B؛ وتوفّر وصفات Strix Halo المخصصة خيارات Q8/Q6/Q5 مع Unsloth Dynamic Quants.
محاكي طيران بعد 63 ساعة. استغرق تشغيل نسخة Qwen3.8-27B بتكميم 3 بت على MacBook Air M2 نحو 63 ساعة، لكنها أنتجت في النهاية محاكي طيران HTML يعمل، ما يُظهر أن البرمجة بالوكلاء محليًا ممكنة لكنها بطيئة.
الأطر والبنية التحتية للوكلاء
الإطار يتفوق على النموذج. رفع إطار Nvidia المخصص، المزوّد بمعالجة الذاكرة ومكوّن إشراف، أداء Claude Opus 5 من 30% إلى 100% على ARC-AGI-3، ما يُظهر أن الغلاف الوكيل قد يكون أكثر تأثيرًا من اختيار النموذج نفسه.
رؤية DeepSeek Flash. يضيف DeepSeek-V4-Flash-Vision-Exp فهم الصور لسير عمل الوكلاء ويقارب Opus 4.8 في المعايير الداخلية للوكلاء؛ ويدعم الإطار المحدّث إدخال الصور في الأوامر وMCP/ACP.
وكلاء Cloudflare للذكاء الاصطناعي. خفّضت Cloudflare عدد المشكلات المفتوحة في Astro بنسبة 85% تقريبًا باستخدام وكلاء GitHub Actions معزولين يعيدون إنتاجها ويشخّصونها ويتحققون منها ويصلحونها؛ كما تعمل على تحويل المعايير الهندسية إلى ضوابط يفرضها الذكاء الاصطناعي.
MCP لـ Azure DevOps. أصبح خادم MCP المستضاف من Microsoft لـ Azure DevOps متاحًا بشكل عام، لكن لا يمكن لـ Claude Desktop وChatGPT وCursor الاتصال به بعد، لأن تسجيل عميل مصادقة Entra غير مدعوم.
تحديثات LLM CLI. يتضمن llm 0.32.1 إصلاحًا لتثبيت تبعية OpenAI المعطوب، ويضيف llm-openrouter 0.7 سجلات الاستدلال وأدوات Shell وWebFetch وWebSearch من جانب الخادم.
إصدارات النماذج والسلامة
كسر حماية Opus 4.6. وجدت TechCrunch أن Claude Opus 4.6 ينتج محتوى جنسيًا صريحًا في 10 من 10 طلبات مباشرة؛ وتشترك النماذج الأقدم في ثغرة كسر حماية متعددة الأدوار، بينما تقاومها إصدارات Opus الحديثة.
أمان Claude Mythos 5. تستخدم Anthropic نموذج Claude Mythos 5 في ماسح أمان للكود مخصص لعملاء المؤسسات، إذ تقترح تصحيحات بموافقة بشرية، وتمنح الشركاء وصولًا دون تفاعل مباشر مع النموذج.
توليد صور بشفافية. يمكن الآن لـ GPT-Image-2 من OpenAI توليد صور PNG بدون خلفية عبر API، وهو مفيد لصور المنتجات والأيقونات؛ ويتم دمج قناة الشفافية أثناء التوليد.
معاينة dots3-note. يضيف llama.cpp دعمًا لنموذج dots3-note، وهو نموذج MoE بحجم 280B مع 16B من المعاملات النشطة وسياق 512 ألف رمز، ويتمتع بفهم متعدد الوسائط للنصوص والصور والفيديو والصوت.
البحوث والمعايير
معيار SWE-bench Science. يُظهر معيار جديد يضم 119 مهمة برمجية علمية أن أفضل وكيل، وهو Claude Code مع Opus-5 max، يسجّل أقل من 50%، مع أنماط فشل شائعة في المعرفة العلمية والاستكشاف والتعميم والتكامل.
مقيّم تتبعات أرخص. نفّذت LangSmith ضبطًا دقيقًا على نموذج Qwen باستخدام Fireworks لكشف الأخطاء التي تُلاحَظ في تتبعات الإنتاج، محققة أداءً يعادل أداء النماذج المتقدمة وتكلفة أقل بما يصل إلى مئة مرة.
قانون تحجيم المحاكاة. تُدير Simile AI، بجولة تمويل Series B بقيمة 2 مليار دولار، محاكاةً للسلوك البشري لشركات Fortune 100، وتدّعي دقة تتراوح بين 85% و99% مقارنة بمجموعات التركيز؛ ويناقش الرئيس التنفيذي Joon Sung Park الانتقال من الوكلاء التوليديين إلى التوائم الرقمية.
الصناعة والأعمال
صفقة Nvidia مع Poolside. تحصل Nvidia على ترخيص لـ Model Factory من Poolside، وتوظّف 109 موظفين مقابل 6 مليارات دولار، مع استثمار إضافي بقيمة مليار دولار؛ والصفقة ليست استحواذًا ولا استحواذًا على المواهب.
استثمارات مراكز البيانات. تحصل Nvidia على حصة أقلية في Cloverleaf Infrastructure لتسريع تطوير مراكز البيانات، وذلك بعد استثمارها 1.5 مليار دولار في SB Energy.
معارضة مراكز البيانات. يعارض الآن 75% من الأمريكيين إقامة مراكز بيانات بالقرب منهم، بعد أن كانت النسبة 42% قبل عام، مع مخاوف بشأن الطاقة والمياه واستخدام الأراضي.
سباق الذكاء الاصطناعي الأميركي-الصيني. تصوغ الولايات المتحدة رسالة تطلب من الدول الشريكة اختيار جانب في الذكاء الاصطناعي، وتحذّر من أن الانضمام إلى مبادرة الصين سيستبعدها من Pax Silica.
قفزة إيرادات OpenAI. رفع GPT-5.6 Sol إيرادات OpenAI الفصلية بنسبة 35% وإيرادات المؤسسات بأكثر من 50%، متفوقًا على نمو أعمال API لدى Anthropic في الربع الثالث.
هذا كل شيء لليوم - قراءة حوالي 5 دقائق.