HeadlinesBriefing favicon HeadlinesBriefing.com

Mercury 2.5: более быстрый и дешевый ИИ

Hacker News •
×

Mercury 2.5 — новейшая модель ИИ от Inception, обеспечивающая значительное улучшение качества по сравнению с Mercury 2 при сохранении того же профиля низкой задержки и низкой стоимости. Теперь это самая большая диффузионная языковая модель на рынке: интеллект увеличен на 40%, а скорость достигает 1107 токенов в секунду на GPU NVIDIA. Модель поддерживает окно контекста 260K и оценивается в $0,20 за миллион входных токенов и $0,75 за миллион выходных токенов, со скидкой 80% при запуске.

Реальные развертывания показывают значительные улучшения. Компания Open Call, занимающаяся голосовым ИИ, сократила задержку ответа с нескольких минут до одной секунды (P99), а Augment Code сократила задержку на 82% и затраты на 90% для агентов кодирования. Эти результаты подчеркивают способность Mercury 2.5 эффективно обрабатывать сложные многоэтапные задачи.

Помимо модели, Inception представляет предварительные версии Mercury Voice и Mercury Router. Mercury Voice оптимизирует время до первого токена менее 170 мс, что идеально для голосовых агентов. Mercury Router интеллектуально направляет запросы к лучшей модели на основе качества, скорости и стоимости, обеспечивая оптимальную производительность для любой рабочей нагрузки.

Mercury 2.5 доступен уже сейчас через Inception API, Baseten и Open Router. Для предприятий Inception предлагает выделенные развертывания, автоматическое масштабирование и средства контроля соответствия. Благодаря сочетанию скорости, интеллекта и доступности Mercury 2.5 готов обеспечить следующее поколение приложений ИИ.

Ключевые субъекты: Компании: Inception, Open Call, Augment Code, NVIDIA | Люди: Oliver Silverstein