إصدارات النماذج
Qwen 3.8 27B. أطلق فريق Qwen التابع لشركة Alibaba نموذج Qwen3.8-27B والنموذج الأكبر Qwen3.8-2.4T-A95B بموجب رخصة Apache 2.0. يتشارك النموذج الكثيف 27B نفس بنية Qwen3.6-27B لكنه يحسّن البرمجة والمهام المكتبية وتخطيط الوكلاء من خلال تغييرات في التدريب. يدعم سياقًا أصليًا يبلغ 262 ألف رمز، وقابلًا للتوسيع إلى مليون رمز.
GLM-5.3 من Zhipu. أصدرت Zhipu AI نموذج GLM-5.3، الذي يستخدم نفس النموذج الأساسي مثل GLM-5.2 لكن مع تدريب لاحق موسّع. تدّعي الشركة أنه أقوى نموذج برمجة مفتوح الأوزان، مع مكاسب ملحوظة في البرمجة الوكيلة واكتشاف الثغرات الأمنية السيبرانية. من المتوقع إتاحة الأوزان على Hugging Face خلال أسبوعين.
Muse Glimmer من Meta. أصدرت Meta نموذج Muse Glimmer مفتوح المصدر، وهو نموذج وكيل بحجم 30 مليار معلم تحت رخصة Apache 2.0 يستهدف سير العمل المحلي على وحدات معالجة الرسوميات الاستهلاكية. يقوم بتقطير مهارات التفكير واستدعاء الأدوات من النموذج الأكبر Muse Spark وكان لفترة وجيزة في طليعة النماذج ذات 30 مليار معلم.
موجة النماذج الصينية مفتوحة المصدر. في أقل من شهر، أصدرت المختبرات الصينية نماذج Kimi K3 وQwen3.8 وDeepSeek-V4-Pro-0813 وGLM-5.3، مما يؤكد التقدم السريع في النماذج مفتوحة الأوزان المتطورة.
النشر المحلي والمجتمع
تسريع على Apple Silicon. إصدار جديد من mlx-dspark يجلب فك الترميز التخميني لنموذج Qwen3.8-27B على Apple Silicon، محققًا سرعة توليد أسرع بنحو 3 أضعاف على M4 Pro مع إنتاج رموز مخرجات مطابقة.
التكميم والأوزان. أصدرت Unsloth أوزان نموذج Qwen3.8-27B المُكمَّمة، وألمح Tim Dettmers إلى طريقة تكميم جديدة قد تتيح تشغيل GLM-5.3 على وحدة DGX Spark واحدة بسرعة 7 رموز في الثانية.
اختبارات مبكرة لـ Qwen 3.8. تظهر اختبارات المجتمع عروضًا قوية للبرمجة من محاولة واحدة وسلوكًا وكيلًا في Qwen3.8-27B، لكن بعض المستخدمين يبلغون عن تقليم ملحوظ في المعرفة العامة وآثار تفكير طويلة جدًا عند جهد استدلال عالٍ جدًا. تتوفر معلمات أخذ العينات الموصى بها على بطاقة النموذج.
- → Qwen 3.8 - 27B is a game changer
- → A hunch: Qwen3.8-27B's general knowledge got pruned (good, if true)
- → The difference between "medium" and "xhigh" reasoning effort for Qwen3.8-27B is actually insane.
- → Qwen 3.8 27B - Aquarium Burst Sample Test
- → RetroCraft - Qwen 3.8 27B Q8, one shot with exact performance data on dual 3090s.
نسخة محلية غير خاضعة للرقابة. نسخة 'هرطقة' مجتمعية من Qwen3.8-27B تزيل الرفض والضمانات، بهدف توفير بديل محلي غير خاضع للرقابة بمستوى نموذج متطور مثل Opus 4.6.
الشفافية والسلامة في الذكاء الاصطناعي
كشف العلامة المائية من Anthropic. ستقدم Anthropic واجهة برمجة تطبيقات للكشف عن العلامة المائية، ليتمكن مطورو الطرف الثالث من اكتشاف النص الذي من المحتمل أن يكون مولّدًا بواسطة Claude. تستخدم الطريقة SynthID Text، وهي أقل موثوقية مع النصوص القصيرة أو كثيفة الحقائق أو المعاد صياغتها بشكل كبير.
Google تجعل العلامة المائية اختيارية. تسمح Google للمستخدمين بإيقاف تشغيل العلامات المائية المرئية على الصور ومقاطع الفيديو والموسيقى المولّدة بالذكاء الاصطناعي من Nano Banana وOmni وLyria. ستظل بيانات SynthID وC2PA الوصفية غير المرئية مضمّنة للتحقق.
حقن التعليمات في المحكمة. وثّق قاضٍ في كونيتيكت ما يبدو أنه أول تقديم في محكمة أمريكية يحتوي على نص مخفي يهدف إلى التلاعب بأنظمة الذكاء الاصطناعي التي تراجع القضية. لم يكن للتعليمات المخفية أي تأثير، لكن القاضي وصف هذا الأسلوب بالخطير.
الوكلاء في الإنتاج
Claude Code يقوم بمهام الصيانة. تقول Anthropic إن Claude Code يقوم بصيانة يومية على تطبيقاته الخاصة، منشئًا 388 طلب سحب (pull request) بمعدل دمج 46 بالمئة بعد مراجعة بشرية. تشمل الإجراءات اختبار الأعطال، وتنظيف التكرارات المجردة، وفحوصات التبعيات.
OpenAI Computer History. يستبدل Computer History من OpenAI النموذج الأولي للقطات الشاشة Chronicle، ويسجل النقرات وضغطات المفاتيح وتبديل التطبيقات على macOS لبناء خط زمني قابل للبحث. يمكنه اكتشاف سير العمل المتكرر واقتراح مهارات قابلة لإعادة الاستخدام لـ ChatGPT وCodex.
الصناعة والأعمال
حرب الأسعار بين الولايات المتحدة والصين. تخفض OpenAI وAnthropic الأسعار بينما تكتسب النماذج الصينية مفتوحة المصدر زخمًا؛ ويظهر Gemini 3.7 Flash من Google مع خصم تمهيدي بنسبة 50 بالمئة يستهدف البرمجة والوكلاء. انخفضت أسعار الرموز من مختبرات أمريكية رائدة بنحو الربع منذ منتصف يوليو.
GPT-5.6 Sol Ultrafast. أطلقت OpenAI معاينة لوضع Ultrafast لنموذج GPT-5.6 Sol المدعوم من Cerebras، حيث يقدم ما يصل إلى 750 رمز مخرجات في الثانية. تقتصر خدمة واجهة البرمجة مبدئيًا على عملاء مختارين وتهدف إلى التحليل الفوري أثناء الحوادث أو أحداث السوق.
ذكاء Meta الاصطناعي للجميع. رافقت Meta إصدار Glimmer برسالة طويلة من زوكربيرج تجادل بأن الذكاء الاصطناعي يجب أن يكون مفتوحًا للجميع، لكن التغطية الصوتية تشير إلى أن الشركة تُبقي نموذجها الأقوى Muse Spark خلف واجهات برمجة التطبيقات. وتشير المناقشات نفسها إلى صفقة استحواذ بقيمة 250 مليون دولار سارت بشكل خاطئ.
نموذج Apple-Alibaba للصين. ذكرت تقارير أن Apple درّبت نموذج ذكاء اصطناعي مخصصًا للسوق الصينية بمساعدة Alibaba، قبل إحضار Apple Intelligence إلى الأجهزة الصينية. تمثل الشراكة تعاونًا نادرًا بين الولايات المتحدة والصين في مجال الذكاء الاصطناعي.
دفعة الاستدلال من Kog. تستخدم الشركة الناشئة الفرنسية Kog تحسينات برمجية لاستخلاص سرعة أكبر من وحدات معالجة الرسوميات التقليدية مثل AMD MI300X وNvidia H200، بهدف تسريع فك الترميز لطلب واحد لتحميلات هندسة البرمجيات.
مخاطر أسعار الغاز الطبيعي. تحذر توقعات جديدة من Noreva من أن أسعار الغاز الطبيعي قد تتضاعف ثلاث مرات في أجزاء من الولايات المتحدة بينما تقوم شركات الحوسبة فائقة النطاق مثل Amazon وGoogle وMeta وMicrosoft بتأمين طاقة الغاز لمراكز البيانات الخاصة بالذكاء الاصطناعي.
أبرز الأبحاث
نموذج ARC بحجم 150 مليون معلم. يحقق نموذج تفكير كامن متكرر بحجم 150 مليون معلم نسبة 29.5% في اختبار ARC-AGI-1 بتكلفة 0.0007 دولار لكل مهمة، خارج حدود التكلفة والدقة المنشورة. يعمل النموذج على أجهزة متواضعة، لكن لا يزال التوسع إلى مليارات المعلمات مطلوبًا.
شكوك حول البحث المستقل. وجدت دراسة من Princeton وUK AISI باستخدام أوراق NeurIPS غير المنشورة أن النماذج المتطورة الحالية تتعامل مع هندسة البحث لكنها تفشل في الأجزاء المهمة من البحث، مناقضةً ادعاءات المختبرات حول البحث المستقل بالذكاء الاصطناعي.
تطور إطار DarwinX. يُطوّر DarwinX أُطر العمل الوكلية من خلال الانتقاء الطبيعي عبر المطالبات والأدوات والمهارات وتدفق التحكم، مع إبقاء أوزان النموذج مجمدة. يضيف حوالي 17 نقطة في المتوسط عبر أربعة معايير وينتقل دون تغيير إلى SWE-bench Verified.
معيار PlayWorld. يقيم معيار PlayWorld نماذج العالم المرئي باستخدام وكلاء متعددي الوسائط يسعون إلى تحقيق 171 هدفًا طويل المدى، ويقيس اتساق الهندسة، ودقة التفاعل، وتطور ما هو خارج الأنظار، وتطور الرؤى.
هذا كل شيء لليوم - قراءة حوالي 5 دقائق.