HeadlinesBriefing favicon HeadlinesBriefing.com

Mercury 2.5: ذكاء اصطناعي أسرع وأرخص

Hacker News •
×

Mercury 2.5 هو أحدث نموذج ذكاء اصطناعي من Inception، ويقدم تحسينًا كبيرًا في الجودة مقارنة بـ Mercury 2 مع الحفاظ على نفس ملف زمن الاستجابة المنخفض والتكلفة المنخفضة. أصبح الآن أكبر نموذج لغة انتشار في السوق، مع زيادة بنسبة 40% في الذكاء وسرعات تصل إلى 1,107 رمزًا في الثانية على وحدات معالجة الرسومات NVIDIA. يدعم النموذج نافذة سياق تبلغ 260 ألف رمز، ويُسعّر بمبلغ 0.20 دولار لكل مليون رمز إدخال و0.75 دولار لكل مليون رمز إخراج، مع خصم إطلاق بنسبة 80%.

تُظهر عمليات النشر في العالم الحقيقي تحسينات هائلة. خفضت شركة Open Call، وهي شركة ذكاء اصطناعي صوتي، زمن استجابة الاستجابة من عدة دقائق إلى ثانية واحدة فقط (P99)، بينما خفضت Augment Code زمن الاستجابة بنسبة 82% والتكاليف بنسبة 90% لوكلاء البرمجة. تسلط هذه النتائج الضوء على قدرة Mercury 2.5 على التعامل مع المهام المعقدة متعددة الخطوات بكفاءة.

بالإضافة إلى النموذج، تقدم Inception معاينة لـ Mercury Voice و Mercury Router. يحسّن Mercury Voice زمن الوصول إلى أول رمز أقل من 170 مللي ثانية، وهو مثالي لوكلاء الصوت. يوجه Mercury Router الاستفسارات بذكاء إلى أفضل نموذج بناءً على الجودة والسرعة والتكلفة، مما يضمن أداءً مثاليًا لأي عبء عمل.

يتوفر Mercury 2.5 الآن عبر Inception API و Baseten و Open Router. للمؤسسات، تقدم Inception عمليات نشر مخصصة وتوسعًا تلقائيًا وضوابط امتثال. بفضل مزيجه من السرعة والذكاء والقدرة على تحمل التكاليف، يستعد Mercury 2.5 لتمكين الجيل التالي من تطبيقات الذكاء الاصطناعي.

الكيانات الرئيسية: الشركات: Inception، Open Call، Augment Code، NVIDIA | الأشخاص: Oliver Silverstein