HeadlinesBriefing favicon HeadlinesBriefing.com

GLM-5.3-Flash: ذكاء اصطناعي متطور بتكلفة خاطفة

Hacker News •
×

2026-08-26 · بحث GLM-5.3-Flash: ذكاء متطور، تكلفة خاطفة* استدعه على Z.ai* خطة ترميز Z.ai* برمج مع ZCode* Hugging Face نقدم GLM-5.3-Flash، أول نموذج متعدد الوسائط أصليًا في سلسلة GLM-5. مع 320B معلمة إجمالية و18B معلمة نشطة فقط، يتفوق على GLM-5.2 في المعايير وأحمال العمل الواقعية بعُشر السعر، مع الاقتراب من Claude Opus 4.8 في معايير الترميز والوكلاء.

يضم GLM-5.3-Flash عدة تحسينات معمارية مقارنة بـ GLM-5. لأول مرة، نقدم بنية هجينة تجمع بين الانتباه المتناثر والخطي، مما يقلل بشكل حاد من تكاليف خدمة السياق الطويل مع الحفاظ على قدرات دقيقة للسياق الطويل. كما يتبنى اتصالات فائقة مقيدة بالمتشعب (m HC) لتحسين كفاءة التوسع. إلى جانب أحدث مجموعة بيانات تدريب مسبق متعددة الوسائط مكونة من 30 تريليون رمز، تسمح هذه التغييرات لـ GLM-5.3-Flash بإنتاج ذكاء أكبر بحوسبة أقل.

قبل الإصدار، اختبرنا GLM-5.3-Flash بشكل مجهول باسم `ox-alpha` على Open Code وOpen Router لجمع ملاحظات المستخدمين. سرعان ما أصبح النموذج الأكثر شعبية في الأسبوع — مع تقديم كل هذه الحركة على رقائق الذكاء الاصطناعي الصينية. يدفع GLM-5.3-Flash حدود باريتو لمؤشر تحليل الذكاء الاصطناعي v4.1.1، مسجلًا 57 بسعر 0.045 دولار فقط لكل مهمة (بعد الخصم) — وهو مستوى من الذكاء لم يكن متاحًا سابقًا إلا بتكلفة تبلغ حوالي 10 أضعاف.

عبر ستة معايير للترميز والوكلاء، يتفوق GLM-5.3-Flash باستمرار على GLM-5.2، غالبًا بفارق كبير — 63.4 مقابل 46.2 على Deep SWE v1.1 و48.8 مقابل 26.2 على Automation Bench — مع الاقتراب من Claude Opus 4.8 بشكل عام. مقارنة بسلسلة GLM-4.5، تم تصميم GLM-5.3-Flash خصيصًا للاستدلال فائق التكلفة المنخفضة، مما يخفض تقريبًا عدد المعلمات النشطة وعدد الطبقات إلى النصف.

الكيانات الرئيسية: الشركات: Z.ai، Hugging Face، Open Code، Open Router