HeadlinesBriefing favicon HeadlinesBriefing.com

Чип Jalapeño от OpenAI обеспечивает прирост производительности ИИ-вывода в 1.5-4.1x

OpenAI Blog •
×

OpenAI опубликовала первые результаты производительности Jalapeño, своего первого кастомного чипа вывода, демонстрируя отраслевое лидерство по скорости и эффективности. Чип обеспечивает 1,5–1,9 раза больше работы ИИ на ватт при пиковой пропускной способности и 1,7–3,6 раза меньшую сквозную задержку по сравнению с ведущими коммерчески доступными системами. Для высоконагруженных интерактивных рабочих нагрузок Jalapeño достиг 2,1–4,1 раза более высокой производительности.

Тесты на моделях GPT‑OSS 120B, Deep Seek R1 и Kimi K2.5 1T показали стабильные улучшения для архитектур, разработанных как внутри, так и вне OpenAI. На самой большой модели Kimi K2.5 1T Jalapeño обеспечил примерно 1,5 раза более высокую пиковую производительность на ватт и 3,4 раза меньшую задержку. Чип рассчитан на 700 ватт, но во время тестирования он работал стабильно на уровне или ниже 550 ватт.

OpenAI подчеркивает преимущество полного стека, проектируя модели, программное обеспечение для обслуживания, чипы, память, сеть и системы совместно, используя данные реальных рабочих нагрузок. Jalapeño представляет начало многопоколенческой платформы, с планами по увеличению производства для выпуска более быстрых, более мощных и эффективных продуктов. Компания измеряла производительность, используя открытый бенчмарк Inference X от Semi Analysis, оценивая эквивалентный пользовательский опыт в диапазонах эксплуатации.

Ключевые сущности: Компании: OpenAI, Semi Analysis