HeadlinesBriefing favicon HeadlinesBriefing.com

Mercury 2.5:更快更便宜的AI模型

Hacker News •
×

Mercury 2.5是Inception的最新AI模型,相比Mercury 2在质量上有显著提升,同时保持了低延迟、低成本的特性。它现在是市场上最大的扩散语言模型,智能提升40%,在NVIDIA GPU上速度达到每秒1,107个token。该模型支持260K上下文窗口,定价为每百万输入token $0.20,每百万输出token $0.75,并享受80%的发布折扣。

实际部署显示了显著的改进。语音AI公司Open Call将响应延迟从几分钟降低到仅1秒(P99),而Augment Code将编码代理的延迟降低了82%,成本降低了90%。这些结果凸显了Mercury 2.5高效处理复杂多步骤任务的能力。

除了模型本身,Inception还预览了Mercury Voice和Mercury Router。Mercury Voice优化了低于170毫秒的首token时间,非常适合语音代理。Mercury Router智能地将提示词根据质量、速度和成本引导到最佳模型,确保任何工作负载都能获得最佳性能。

Mercury 2.5现已通过Inception API、Baseten和Open Router提供。对于企业客户,Inception提供专用部署、自动扩展和合规控制。凭借速度、智能和可负担性的结合,Mercury 2.5将助力下一代AI应用。

关键实体:公司:Inception、Open Call、Augment Code、NVIDIA | 人物:Oliver Silverstein