HeadlinesBriefing favicon HeadlinesBriefing.com

DeepSeek-V4.1-Flash: छोटा और तेज़ AI मॉडल

Hacker News •
×

DeepSeek ने DeepSeek-V4.1-Flash पेश किया, जो अपनी नई आर्किटेक्चर फैमिली का सबसे छोटा मॉडल है, जिसमें मूलभूत दृश्य समझ है और इसे अधिक क्षमता, तेज़ इन्फरेंस और उच्च थ्रूपुट के लिए डिज़ाइन किया गया है। मॉडल असममित आर्किटेक्चर का उपयोग करता है जिसमें 552B-पैरामीटर MoE और एक नया Causal Encoder–Decoder डिज़ाइन है, जिसमें इनपुट के लिए केवल 8B सक्रिय पैरामीटर और आउटपुट के लिए 16B की आवश्यकता होती है। पिछली पीढ़ी की तुलना में, V4.1-Flash KV कैश की आवश्यकता को HBM के 1/4 और SSD स्टोरेज के 1/8 तक कम कर देता है, कैश-हिट शुल्क को संपीड़ित करके एजेंट लागत को काफी कम कर देता है। मॉडल अब DeepSeek API पर लाइव है जिसमें मूलभूत मल्टीमोडल समर्थन है; उपयोगकर्ताओं को अपना मॉडल deepseek-flash पर सेट करना चाहिए। V4-Flash और V4-Flash-Vision-Exp सेवानिवृत्त हो गए हैं, संगतता के लिए V4.1-Flash में अस्थायी रूटिंग की गई है। DeepSeek बताता है कि सुधारी हुई दक्षता के कारण API की कीमतें कम हो गई हैं, बचत को उपयोगकर्ताओं तक पहुंचा रहा है, और शीर्ष/अशिखर मूल्य निर्धारण बनाए रखे हुए है, जिसमें अशिखर दरें शीर्ष दरों की 50% हैं। कंपनी ओपन-सोर्स समुदाय के साथ इन्फरेंस समर्थन पर सहयोग कर रही है और तैनाती विकल्पों की खोज कर रही है, 2,000 GPU और स्टोरेज क्लस्टर वाले बड़े पैमाने पर सेटअप के लिए पूछताछ का आमंत्रण दे रही है। मॉडल Hugging Face पर deepseek-ai/DeepSeek-V4.1-Flash के रूप में उपलब्ध है।