HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI Jalapeño 芯片提供 1.5-4.1 倍 AI 推理性能提升

OpenAI Blog •
×

OpenAI 发布了其首款定制推理芯片 Jalapeño 的首批性能结果,展示了行业领先的速度和效率。该芯片在峰值吞吐量下每瓦特可完成 1.5 到 1.9 倍 更多的 AI 工作量,相比领先的商用系统端到端延迟降低了 1.7 到 3.6 倍。对于高度交互式工作负载,Jalapeño 达到了 2.1 到 4.1 倍 的性能提升。

GPT‑OSS 120BDeep Seek R1Kimi K2.5 1T 模型上的测试显示,无论是 OpenAI 内部还是外部开发的架构,性能提升均保持一致。在最大模型 Kimi K2.5 1T 上,Jalapeño 每瓦特峰值性能提高了约 1.5 倍,端到端延迟降低了 3.4 倍。该芯片额定功率为 700 瓦,但在测试期间持续功率保持在或低于 550 瓦

OpenAI 强调全栈优势,通过真实工作负载数据,将模型、服务软件、芯片、内存、网络和系统一体化设计。Jalapeño 代表多代平台的开端,公司计划提升产能以交付更快、更强大、更高效的产品。性能测试使用了 Semi Analysis 公开的 Inference X 基准,在匹配用户体验的操作范围内进行评估。

关键实体:公司:OpenAI,Semi Analysis

FAQ:Jalapeño 与现有 AI 推理硬件相比如何?

Jalapeño 每瓦特可完成比领先商用系统多 1.5-1.9 倍 的 AI 工作量,端到端延迟降低 1.7-3.6 倍,在高度交互式工作负载下性能提升达 2.1-4.1 倍,而其持续功耗为 550W,额定功率为 700W