HeadlinesBriefing favicon HeadlinesBriefing.com

पश्चिम चीनी AI प्रगति अपनाता है

Hacker News •
×

यदि आप इन दिनों समाचार सुर्खियाँ पढ़ते हैं, तो आपको यह सोचने के लिए माफ किया जा सकता है कि पश्चिमी प्रयोगशालाएं चीनी प्रयोगशालाओं द्वारा बड़े पैमाने पर स्पॉन-कैंप की जा रही हैं। एक सप्ताह भी नहीं जाता जब Anthropic एक और लेख जारी नहीं करता कि कैसे चीनी अपने मॉडलों को डिस्टिल कर रहे हैं, स्वयं मानवता के लिए खतरा बन रहे हैं। उनके लिए यह कहना लाभदायक है क्योंकि यह बाद में कानूनी और नियामक रूप से इन मॉडलों को प्रतिबंधित करने की नींव रखता है। लेकिन बिना सोचे-समझे डिस्टिलिंग के दिन खत्म हो गए हैं। नया खेल चीनी प्रयोगशालाओं की प्रगति को अपनाना है।

सबसे नवीनतम जिसे बेशर्मी से बिना स्वीकृति के कॉपी किया गया, वह KV कैश ऑप्टिमाइज़ेशन में सफलता है जिसे Deep Seek ने उदारतापूर्वक साझा किया है। इसने कुछ उपयोग मामलों के लिए KV कैश फुटप्रिंट को Deep Seek-V1 की तुलना में लगभग 437x के कारक से कम कर दिया। नवीनतम Deep Seek-V4.1-Flash इसे CSA2, क्रॉस-लेयर कैश पुन: उपयोग, एक कारण एनकोडर-डिकोडर आर्किटेक्चर और FP4 कैशिंग के साथ और आगे बढ़ाता है, वैश्विक KV कैश को प्रति टोकन 890 बाइट्स तक लाता है।

इस सब का मतलब होना चाहिए कि पश्चिमी AI कंपनियां अब अत्यधिक अनुमान-मार्जिन सकारात्मक हैं। उन्नत GPU तक पहुंच पर प्रतिबंधों ने चीनी प्रयोगशालाओं को प्रदर्शन अनुकूलन को नंबर एक लक्ष्य बनाने के लिए मजबूर किया। अब Anthropic और Open AI दोनों ने इन अनुकूलनों का उपयोग करते हुए मॉडल जारी किए। कैश रीड लागत में तेजी से गिरावट आई: Opus 5.5 ने Opus 5 की तुलना में कैश-रीड मूल्य निर्धारण में 60% की कटौती की, जबकि GPT-6.1 Sol ने GPT-5.6 Sol के जुलाई के अंत के मूल्य निर्धारण की तुलना में 80% की कटौती की।