HeadlinesBriefing favicon HeadlinesBriefing.com

Chip Jalapeño da OpenAI oferece ganhos de 1.5-4.1x na inferência de IA

OpenAI Blog •
×

OpenAI publicou os primeiros resultados de desempenho de Jalapeño, seu primeiro chip de inferência personalizado, demonstrando velocidade e eficiência líderes da indústria. O chip oferece 1,5 a 1,9 vezes mais trabalho de IA por watt no desempenho máximo e 1,7 a 3,6 vezes menos latência de ponta a ponta em comparação com os sistemas comerciais líderes disponíveis. Para cargas de trabalho altamente interativas, Jalapeño alcançou 2,1 a 4,1 vezes um desempenho mais alto.

Os testes nos modelos GPT‑OSS 120B, Deep Seek R1 e Kimi K2.5 1T mostraram ganhos consistentes para arquiteturas desenvolvidas tanto dentro quanto fora da OpenAI. No maior modelo, Kimi K2.5 1T, Jalapeño entregou aproximadamente 1,5 vezes mais desempenho máximo por watt e 3,4 vezes menos latência. O chip é classificado em 700 watts, mas operou continuamente em ou abaixo de 550 watts durante os testes.

A OpenAI enfatiza uma vantagem de pilha completa, projetando modelos, software de serviço, chips, memória, rede e sistemas juntos usando dados reais de carga de trabalho. Jalapeño representa o início de uma plataforma multigeracional, com planos para aumentar a produção e entregar produtos mais rápidos, mais capazes e eficientes. A empresa mediu o desempenho usando o benchmark público Inference X da Semi Analysis, avaliando uma experiência de usuário correspondente nas faixas de operação.

Entidades-chave: Empresas: OpenAI, Semi Analysis