HeadlinesBriefing favicon HeadlinesBriefing.com

Qwen3.8-Flash-Next: علي بابا تعرض Qwen4

Hacker News •
×

أصدرت علي بابا Qwen3.8-Flash-Next، وهو نموذج مفتوح الأوزان متعدد الوسائط لخبراء مختلطين مبني على بنية Qwen4، قبل وجود أي نموذج Qwen4. تم نشر مستودع Hugging Face الرسمي في 24 أغسطس، قبل يومين من الإصدار المقرر لـ Model Scope في 26 أغسطس. تؤكد بطاقة النموذج أنه "معاينة تجريبية للبنية التي ستقوم عليها Qwen4".

تشمل التغييرات المعمارية الرئيسية شبكة دلتا المُبوَّبة (GDN) وانتباه Qwen المتناثر (QSA)، ضمن طبقة هجينة من 48 طبقة، مع 36 طبقة انتباه خطي و12 طبقة انتباه كامل. يحتوي النموذج على 125B معلمة إجمالية مع 6B مُفعَّلة لكل رمز، و512 خبيرًا، وجدول تضمين n-gram منفصل بحجم 51B، وسياق أصلي 262,144 رمزًا، قابل للتوسيع إلى 1,000,000. الأوزان غير مُبوَّبة ومحددة بالكامل.

تقدم علي بابا هذا كالتزام تقني: معاينة الجزء الصعب أولاً، بحيث تكون بيئات التشغيل والتطبيقات جاهزة لعائلة Qwen4. ومع ذلك، تظل نتائج المعايير غير مؤكدة وغير مُعاد إنتاجها بشكل مستقل. لا يزال الإصدار الرسمي لـ Model Scope مقررًا في 2026-08-26 23:00 (UTC+08:00)، لكن الأوزان سبقت المؤقت.

الكيانات الرئيسية: الشركات: Alibaba | الأشخاص: @kimmonismus | المواقع: Hugging Face, Model Scope