HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI JalapeñoチップがAI推論で1.5-4.1xの性能向上を実現

OpenAI Blog •
×

OpenAIは、Jalapeñoと呼ばれる初めてのカスタム推論チップの初のパフォーマンス結果を発表し、業界をリードする速度と効率を示しました。このチップは、ピークスループット時にワットあたりのAI処理能力を1.5〜1.9倍向上させ、主要な商用システムと比較してエンドツーエンドのレイテンシーを1.7〜3.6倍削減します。高度にインタラクティブなワークロードでは、Jalapeñoは2.1〜4.1倍の性能向上を達成しました。

GPT‑OSS 120BDeep Seek R1、およびKimi K2.5 1Tモデルでのテストでは、OpenAI内外で開発されたアーキテクチャの両方に対して一貫した性能向上が示されました。最大のモデルであるKimi K2.5 1Tでは、Jalapeñoはワットあたりのピークパフォーマンスを約1.5倍向上させ、レイテンシーを3.4倍削減しました。このチップの定格消費電力は700ワットですが、テスト中は持続的に550ワット以下で動作しました。

OpenAIは、実際のワークロードデータを使用してモデル、サービスソフトウェア、チップ、メモリ、ネットワーク、システムをフルスタックで設計することによる利点を強調しています。Jalapeñoはマルチジェネレーションプラットフォームの始まりを表し、より高速で、より機能的で、より効率的な製品を提供するために生産を拡大する計画があります。パフォーマンスは、Semi Analysisによる公開のInference Xベンチマークを使用して測定され、動作範囲全体でユーザー体験を一致させて評価されました。

主要なエンティティ: 企業: OpenAI, Semi Analysis