HeadlinesBriefing favicon HeadlinesBriefing.com

DeepSeek-V4.1-Flash: نموذج ذكاء اصطناعي أصغر وأسرع

Hacker News •
×

أطلقت DeepSeek نموذج DeepSeek-V4.1-Flash، أصغر نموذج في عائلة هندستها الجديدة، الذي يتميز بفهم بصري أصلي ومصمم لزيادة القدرة، وتسريع الاستنتاج، وزيادة الإنتاجية. يستخدم النموذج هندسة غير متماثلة مع MoE بحجم 552B معلمة وتصميم جديد لمُشفِّر–فكِّتر سببي، ويتطلب فقط 8B معلمة نشطة للإدخال و16B للإخراج. مقارنةً بالجيل السابق، يقلل V4.1-Flash احتياجات ذاكرة التخزين المؤقت KV إلى 1/4 من HBM و1/8 من تخزين SSD، مما يقلل بشكل كبير من تكاليف الوكلاء عبر ضغط رسوم التخزين المؤقت عند الإصابة. النموذج الآن متاح مباشرة على واجهة برمجة تطبيقات DeepSeek مع دعم أصلي متعدد الوسائط؛ يجب على المستخدمين ضبط نموذجهم على deepseek-flash. تم إيقاف V4-Flash وV4-Flash-Vision-Exp، مع توجيه مؤقت إلى V4.1-Flash لضمان التوافق. تُبلغ DeepSeek عن انخفاض أسعار واجهة برمجة التطبيقات بسبب تحسين الكفاءة، مع تمرير المدخرات إلى المستخدمين، وتحافظ على أسعار الذروة/غير الذروة مع أسعار غير الذروة عند 50% من أسعار الذروة. تتعاون الشركة مع مجتمع المصدر المفتوح لدعم الاستنتاج وتستكشف خيارات النشر، وتدعو إلى الاستفسارات حول الإعدادات الكبيرة الحجم التي تتضمن 2000 وحدة معالجة رسومات ومجموعات تخزين. النموذج متاح على Hugging Face باسم deepseek-ai/DeepSeek-V4.1-Flash.