OpenAI представила революционный чип Jalapeño, превосходящий Nvidia
25 августа OpenAI поделилась результатами тестирования своего чипа Jalapeño для инференса. Устройство продемонстрировало 1,5–1,9-кратное увеличение вычислительной мощности на ватт и снижение задержки в 1,7–3,6 раза по сравнению с Nvidia GB200 и GB300.
При тестировании на интерактивные нагрузки производительность Jalapeño превысила показатели конкурентов в 2,1–4,1 раза. OpenAI планирует внедрить новый процессор в свою инфраструктуру до конца 2026 года.
Тестирование проводилось с использованием бенчмарка InferenceX от SemiAnalysis для оценки пропускной способности и задержки. В сравнении с Nvidia GB200, Jalapeño демонстрировал в 1,9 раза большую пиковую производительность на киловатт для GPT-OSS 120B.
На DeepSeek R1 670B Jalapeño обеспечил в 1,7 раза лучшую производительность, снижая задержку в 3,6 раза по сравнению с GB300. Для Kimi K2.5 1T прирост составил 1,5 раза в эффективности и 3,4 раза в скорости.
Сравнение энергопотребления показало, что чип OpenAI потребляет 700 Вт, а фактическая нагрузка в тестах не превышала 550 Вт. В разработке Jalapeño активно применялись ИИ-технологии OpenAI, что позволило ускорить процесс создания.
Благодаря ИИ, команда OpenAI добилась высокой производительности Jalapeño на трех моделях за короткий срок. В отдельных компонентах ИИ-реализации оказались быстрее традиционных инженерных решений.
OpenAI рассматривает Jalapeño как часть более широкой интегрированной инфраструктуры, включая дата-центры и программное обеспечение. Контроль над чипами позволяет оптимизировать стоимость инференса и выбирать оптимальное оборудование.
Несмотря на разработку собственного чипа, OpenAI продолжит использовать сторонние ускорители для обучения и инференса. Будущее поколение Jalapeño уже разрабатывается, и первые чипы внедрят до конца года.
Компания недавно временно замедлила развертывание новых ИИ-моделей для оптимизации процессов.