HeadlinesBriefing favicon HeadlinesBriefing.com

Mercury 2.5: দ্রুত ও সস্তা AI মডেল

Hacker News •
×

Mercury 2.5 হল Inception-এর সর্বশেষ AI মডেল, যা Mercury 2-এর তুলনায় উল্লেখযোগ্য মানের উন্নতি প্রদান করে, একই সাথে কম-বিলম্ব, কম-খরচ প্রোফাইল বজায় রাখে। এটি এখন বাজারে সবচেয়ে বড় ডিফিউশন ভাষা মডেল, যেখানে বুদ্ধিমত্তায় 40% বৃদ্ধি এবং NVIDIA GPU-তে প্রতি সেকেন্ডে 1,107 টোকেন গতি। মডেলটি 260K কনটেক্সট উইন্ডো সমর্থন করে এবং প্রতি মিলিয়ন ইনপুট টোকেনে $0.20 এবং প্রতি মিলিয়ন আউটপুট টোকেনে $0.75 মূল্যে নির্ধারিত, যার সাথে 80% লঞ্চ ছাড়।

বাস্তব-বিশ্বের স্থাপনাগুলি নাটকীয় উন্নতি দেখায়। ভয়েস AI কোম্পানি Open Call প্রতিক্রিয়া বিলম্ব কয়েক মিনিট থেকে মাত্র এক সেকেন্ডে (P99) কমিয়েছে, যখন Augment Code কোডিং এজেন্টদের জন্য বিলম্ব 82% এবং খরচ 90% কমিয়েছে। এই ফলাফলগুলি জটিল, বহু-পদক্ষেপ কাজগুলি দক্ষতার সাথে পরিচালনা করার Mercury 2.5-এর ক্ষমতা তুলে ধরে।

মডেল ছাড়াও, Inception Mercury Voice এবং Mercury Router-এর প্রিভিউ দিচ্ছে। Mercury Voice 170ms-এর নিচে সময়-থেকে-প্রথম-টোকেন অপ্টিমাইজ করে, যা ভয়েস এজেন্টদের জন্য আদর্শ। Mercury Router গুণমান, গতি এবং খরচের ভিত্তিতে প্রম্পটগুলিকে সেরা মডেলে বুদ্ধিমানের সাথে নির্দেশ করে, যেকোনো কাজের জন্য সর্বোত্তম কর্মক্ষমতা নিশ্চিত করে।

Mercury 2.5 এখন Inception API, Baseten এবং Open Router-এর মাধ্যমে উপলব্ধ। এন্টারপ্রাইজগুলির জন্য, Inception ডেডিকেটেড স্থাপনা, অটোস্কেলিং এবং সম্মতি নিয়ন্ত্রণ প্রদান করে। গতি, বুদ্ধিমত্তা এবং সাশ্রয়ীতার সংমিশ্রণে, Mercury 2.5 AI অ্যাপ্লিকেশনের পরবর্তী প্রজন্মকে শক্তি দেওয়ার জন্য প্রস্তুত।

মূল সত্তা: কোম্পানি: Inception, Open Call, Augment Code, NVIDIA | ব্যক্তি: Oliver Silverstein