إصدارات النماذج والذكاء الاصطناعي المحلي
نموذج Sori-1B الصوتي-اللغوي. نموذج بمعاملات تبلغ 1B دُرِّب من الصفر على نصوص مقترنة بالصوت، دون تدريب مسبق على النصوص فقط، ويهدف إلى ربط الإجابات بالصوت. يستخدم مُرمِّز Audio Flamingo Next المُجمَّد من NVIDIA وTokenizer مخصصًا لأنطولوجيا السمع، وهو مُتاح بموجب ترخيص غير تجاري/أكاديمي.
موجة Qwen3.8 المحلية. تشير تقارير المجتمع إلى تشغيل Qwen3.8-27B وFlash Next على أجهزة تتراوح من هاتف بذاكرة 12GB (3.5 رمز/ثانية) إلى أربع بطاقات R9700 (توليد 80-120 رمزًا/ثانية مع سياق 700k). في أعباء العمل المحلية للوكلاء، يكون Flash Next أسرع وموثوقًا تشغيليًا، بينما يظل النموذج الكثيف 27B أقوى للاستخدام متعدد الأدوار المستمر؛ ويجد بعض المستخدمين النماذج كثيفة، رغم الإشادة بجودة الترجمة إلى الألمانية.
- → Qwen3.8-Flash-Next-NVFP4 vs Qwen3.8-27B-FP Test Results
- → Qwen 3.8 27B - Fantastic German capabilities
- → Unpopular opinion Qwen 3.8 is hard to understand
- → Qwen 3.8 Flash Next locally on simple mobile phone at 3.5 tok/s
- → Here my pretty good qwen3.8 27B setup, hope it helps
- → Qwen3.8-Flash-Next turns 4xR9700 into a local AI powerhouse! 120 t/s TG and 12k t/s PP single request with optimized vLLM
إصدارات GGUF غير مقيّدة. نشر مستخدم على Reddit ملفات GGUF لنماذج LongCat-Flash-Lite-Sparse، وهو نموذج انتباه متفرق 69B-A3B بسياق 1M، بالإضافة إلى Qwen3.8-27B مع MTPs، وQwen3.5-122B-A10B، وQwen3-Coder-Next، ونموذج رؤية. يتطلب دعم LongCat نسخة معدلة من llama.cpp.
أجهزة ذكاء اصطناعي مكتبية. يوفر كمبيوتر DGX Station المكتبي من NVIDIA أداءً بمستوى مراكز البيانات مع نطاق ترددي للذاكرة يبلغ 7.1TB/s، بينما يبدو أن Framework تستعد لإطلاق لوحة أم بذاكرة 192GB بسعر متوقع نحو 4.5 ألف دولار.
المعايير والتقييمات
معيار اختبار الاختراق لنماذج LLM. يختبر معيار جديد نماذج LLM ضد بنية تحتية حية يتعين عليها مهاجمتها، بهدف تحديد أفضل نموذج لأعمال الأمن الهجومي بدلًا من إعادة إنتاج ثغرات CVE المعروفة.
مؤشر معايير البرمجة. جمع مستخدم على Reddit أبرز معايير البرمجة بالوكلاء في مؤشر «Agentic Coding Index» واحتسب مقياسًا لكثافة الذكاء لمقارنة قدرة النموذج لكل معامل.
تقييم VLM مفتوح بمنظور شخصي. باستخدام HFlow على معيار فيديو من منظور الشخص الأول، حقق نموذج Gemma البصري اللغوي المفتوح أداءً مماثلًا لـ Gemini 2.5 Flash في مقاييس رؤية اليد والتلاعب مع كونه أرخص 19 مرة، ما يجعل المعالجة الخاصة ذاتية الاستضافة ممكنة.
الأدوات وأطر الوكلاء
بحث Cloudflare AI. تقدم خدمة AI Search من Cloudflare الآن خط أنابيب بحث متكاملًا للبيانات المخصصة، مع التكامل مع الوكلاء، والبحث متعدد الوسائط، ووضع الاكتشاف الذي يمكنه فهرسة المواقع بدون خرائط مواقع.
Kiro Crew من AWS. أصدرت AWS Kiro Crew مفتوح المصدر، وهو مساحة عمل لتشغيل عدة وكلاء برمجة غير متزامنين مع ذاكرة مشتركة، ومهارات قابلة لإعادة الاستخدام، ومهام مجدولة؛ وقد استُخدم داخليًا من قبل أكثر من 39,000 مطور.
شرح ChatGPT Work. يتوفر ChatGPT Work من OpenAI في الخطط المدفوعة، بنسخة سحابية عبر chatgpt.com ونسخة محلية للحاسوب المكتبي يمكنها الوصول إلى الملفات وتشغيل البرامج، لكن الحدود بينه وبين Chat ما تزال مربكة.
خفض حد Claude Code. الزيادة القادمة بنسبة 25% في الحد الأساسي لاستخدام Claude Code من Anthropic هي في الواقع خفض فعلي بنسبة 17% مقارنة بالزيادة المؤقتة الحالية البالغة 50%؛ كما أضافت أداة تلقائية للإبلاغ عن الأخطاء.
الأبحاث والتحليلات
الوكلاء يفتقرون إلى إدراك الوقت. وجدت دراسة أن Claude Code وCodex يخطئان باستمرار في تقدير المدة التي تستغرقها المهام، إذ يبالغان في تقدير المهام القصيرة بنسبة 3 إلى 10 أضعاف، وهو أمر إشكالي للمهام الوكلائية طويلة الأمد.
PILOT وتحسين ذاتي لحظي. PILOT هو نظام المشرف-العامل الذي يضيف توجيهًا لحظيًا وتطورًا ذاتيًا لحظيًا للوكلاء بعيدة الأفق، متفوقًا على الأنظمة المناظرة بما يصل إلى 9.8 نقاط على Terminal-Bench 2.0.
GameWAM نموذج العالم-الفعل. GameWAM هو أول نموذج عالم-فعل يعمل مباشرة على فيديو اللعب، فيولّد الإطارات المستقبلية وأفعال لوحة المفاتيح والفأرة معًا عبر مطابقة التدفق، مع تحكم طويل الأفق في دورات الكتل.
تعلم الاستدلال بالقطعة التالية مقابل SFT. تظهر دراسة مضبوطة أن SFT المختلط على بيانات بدون CoT وبيانات ذات CoT طويل يتفوق على تعلم التعزيز للاستدلال بالقطعة التالية كاستراتيجية تدريب قبل RLVR، مع حوسبة أقل بأكثر من 60 مرة.
نقاش حول فاعلية الذكاء الاصطناعي. بالاستناد إلى حادثة Hugging Face في يوليو، يرى مقال أن فاعلية الذكاء الاصطناعي، وليس مجرد القدرات، هي التي ستحدد النتائج، وأن كيفية منح المستخدمين لهذه الفاعلية أو تقييدها أمر مهم.
الصناعة والسياسة والأعمال
NVIDIA تستحوذ على Hugging Face. من شأن صفقة بقيمة 12.9 مليار دولار لاستحواذ NVIDIA على Hugging Face أن تمزج بين البنية التحتية للحوسبة والمحور الرئيسي لتوزيع النظام البيئي للنماذج المفتوحة، ما يسرّع التحول الصناعي للذكاء الاصطناعي.
حواجز تجارية أمريكية للروبوتات. شددت واشنطن القيود والرسوم الجمركية على الطائرات بدون طيار والروبوتات الصينية مستشهدة بالأمن القومي، غير أن حجم التصنيع الصيني ومزاياه التكلفية قد يضعفان أثر ذلك عالميًا.
الذكاء الاصطناعي في الصناعة. تختبر Meta روبوتات من Watney وKinova وABB لإعادة تشغيل الخوادم، وتبديل الكابلات، وإعادة تشغيل التيار الكهربائي في مراكز البيانات؛ وتطبق Caterpillar دروس الأنظمة الذاتية في التعدين على قطاع البناء، وتستخدم مساعدي ذكاء اصطناعي للفنيين.
ماسك يسبك قطع التوربينات داخليًا. تبني SpaceX مسبكًا لشفرات وريش توربينات الغاز؛ ويقول ماسك إن الصب داخليًا قد يعجّل توليد الكهرباء بالغاز الطبيعي لمراكز بيانات الذكاء الاصطناعي بما يصل إلى 18 شهرًا.
تراجع مشاعر العمال تجاه الذكاء الاصطناعي. تظهر بيانات Glassdoor أن المشاعر الإيجابية للعمال الأمريكيين تجاه الذكاء الاصطناعي انخفضت من 81% في 2019 إلى 43% بحلول منتصف 2026، حيث كان المدراء الأكثر تفاؤلًا، ونساء الجيل Z والكتّاب وعاملو التأمين الأكثر سلبية.
شركات الموسيقى تقاضي Anthropic. تزعم Sony Music وWarner Music وغيرهما أن Anthropic نزّلت عبر التورنت بشكل غير قانوني عشرات الآلاف من كلمات الأغاني المحمية بحقوق النشر لتدريب Claude، مع تسمية الرئيس التنفيذي داريو أمودي والمؤسس المشارك بنجامين مان شخصيًا.
تكساس توقف كاميرات Flock. جمّد الحاكم أبوت إنفاق الولاية على كاميرات المراقبة الذكية Flock بعد إنفاق أكثر من 30 مليون دولار، وسط مخاوف خصوصية من الحزبين وحوادث إساءة استخدام من الضباط.
هذا كل شيء لليوم - قراءة حوالي 5 دقائق.