HeadlinesBriefing favicon HeadlinesBriefing.com

OpenAI Jalapeño Chip liefert 1.5-4.1x höhere KI-Inferenzleistung

OpenAI Blog •
×

OpenAI hat die ersten Leistungsergebnisse für Jalapeño, seinen ersten maßgeschneiderten Inferenzchip, veröffentlicht, die branchenführende Geschwindigkeit und Effizienz demonstrieren. Der Chip liefert bei Spitzendurchsatz 1,5 bis 1,9 Mal mehr KI-Arbeit pro Watt und weist im Vergleich zu den führend kommerziell erhältlichen Systemen eine 1,7 bis 3,6 Mal geringere End-to-End-Latenz auf. Bei hochgradig interaktiven Arbeitslasten erreichte Jalapeño 2,1 bis 4,1 Mal höhere Leistung.

Die Tests an den Modellen GPT‑OSS 120B, Deep Seek R1 und Kimi K2.5 1T zeigten konsistente Verbesserungen für Architekturen, die sowohl innerhalb als auch außerhalb von OpenAI entwickelt wurden. Beim größten Modell, Kimi K2.5 1T, lieferte Jalapeño etwa 1,5 Mal höhere Spitzleistung pro Watt und 3,4 Mal geringere Latenz. Der Chip ist mit 700 Watt bewertet, arbeitete jedoch während der Tests kontinuierlich bei oder unter 550 Watt.

OpenAI betont den Vorteil eines vollständigen Stacks, indem es Modelle, Service-Software, Chips, Speicher, Netzwerke und Systeme gemeinsam unter Verwendung echter Arbeitslastdaten entwirft. Jalapeño repräsentiert den Beginn einer mehrgenerationalen Plattform, wobei Pläne bestehen, die Produktion hochzufahren, um schnellere, leistungsfähigere und effizientere Produkte zu liefern. Die Leistung wurde anhand des öffentlichen Inference X-Benchmarks von Semi Analysis gemessen, wobei bei entsprechenden Benutzererfahrungen über die Betriebsbereiche hinweg evaluiert wurde.

Wichtige Entitäten: Unternehmen: OpenAI, Semi Analysis