HeadlinesBriefing favicon HeadlinesBriefing.com

El chip Jalapeño de OpenAI ofrece ganancias de 1.5-4.1x en inferencia de IA

OpenAI Blog •
×

OpenAI ha publicado los primeros resultados de rendimiento de Jalapeño, su primer chip de inferencia personalizado, demostrando velocidad y eficiencia líderes en la industria. El chip ofrece 1.5 a 1.9 veces más trabajo de IA por vatio en rendimiento máximo y 1.7 a 3.6 veces menor latencia de extremo a extremo en comparación con los sistemas comerciales líderes disponibles. Para cargas de trabajo altamente interactivas, Jalapeño logró 2.1 a 4.1 veces un rendimiento más alto.

Las pruebas en los modelos GPT‑OSS 120B, Deep Seek R1 y Kimi K2.5 1T mostraron ganancias consistentes para arquitecturas desarrolladas tanto dentro como fuera de OpenAI. En el modelo más grande, Kimi K2.5 1T, Jalapeño ofreció aproximadamente 1.5 veces más rendimiento máximo por vatio y 3.4 veces menor latencia. El chip está clasificado en 700 vatios, pero operó sostenidamente en o por debajo de 550 vatios durante las pruebas.

OpenAI enfatiza una ventaja de pila completa, diseñando modelos, software de servicio, chips, memoria, redes y sistemas juntos utilizando datos de carga de trabajo reales. Jalapeño representa el comienzo de una plataforma multigeneracional, con planes para aumentar la producción y entregar productos más rápidos, más capaces y eficientes. La empresa midió el rendimiento utilizando el benchmark público Inference X de Semi Analysis, evaluando una experiencia de usuario coincidente en los rangos de operación.

Entidades clave: Empresas: OpenAI, Semi Analysis