HeadlinesBriefing favicon HeadlinesBriefing.com

Mercury 2.5: तेज़ और सस्ता AI मॉडल

Hacker News •
×

Mercury 2.5 Inception का नवीनतम AI मॉडल है, जो Mercury 2 की तुलना में महत्वपूर्ण गुणवत्ता सुधार प्रदान करता है, साथ ही समान कम-विलंबता, कम-लागत प्रोफ़ाइल बनाए रखता है। यह अब बाजार में सबसे बड़ा डिफ्यूज़न भाषा मॉडल है, जिसमें बुद्धिमत्ता में 40% की वृद्धि और NVIDIA GPU पर 1,107 टोकन प्रति सेकंड की गति है। मॉडल 260K संदर्भ विंडो का समर्थन करता है और इसकी कीमत $0.20 प्रति मिलियन इनपुट टोकन और $0.75 प्रति मिलियन आउटपुट टोकन है, जिसमें 80% लॉन्च छूट शामिल है।

वास्तविक दुनिया की तैनाती नाटकीय सुधार दिखाती है। वॉयस AI कंपनी Open Call ने प्रतिक्रिया विलंबता को कई मिनटों से घटाकर केवल एक सेकंड (P99) कर दिया, जबकि Augment Code ने कोडिंग एजेंटों के लिए विलंबता में 82% और लागत में 90% की कटौती की। ये परिणाम जटिल, बहु-चरणीय कार्यों को कुशलतापूर्वक संभालने की Mercury 2.5 की क्षमता को उजागर करते हैं।

मॉडल के अलावा, Inception Mercury Voice और Mercury Router का पूर्वावलोकन कर रहा है। Mercury Voice 170ms से कम समय-से-पहला-टोकन के लिए अनुकूलित करता है, जो वॉयस एजेंटों के लिए आदर्श है। Mercury Router गुणवत्ता, गति और लागत के आधार पर संकेतों को सर्वोत्तम मॉडल की ओर बुद्धिमानी से निर्देशित करता है, जिससे किसी भी कार्यभार के लिए इष्टतम प्रदर्शन सुनिश्चित होता है।

Mercury 2.5 अब Inception API, Baseten और Open Router के माध्यम से उपलब्ध है। उद्यमों के लिए, Inception समर्पित तैनाती, ऑटोस्केलिंग और अनुपालन नियंत्रण प्रदान करता है। गति, बुद्धिमत्ता और सामर्थ्य के संयोजन के साथ, Mercury 2.5 AI अनुप्रयोगों की अगली पीढ़ी को शक्ति देने के लिए तैयार है।

मुख्य संस्थाएँ: कंपनियाँ: Inception, Open Call, Augment Code, NVIDIA | लोग: Oliver Silverstein