OpenAI представила Jalapeño — чип, превосходящий Nvidia по эффективности
В конце августа компания OpenAI обнародовала результаты испытаний своего нового чипа Jalapeño, предназначенного для инференса. Тесты показали, что Jalapeño превосходит системы на базе Nvidia GB200 и GB300: он обеспечивает в 1,5–1,9 раза больше вычислительной мощности на каждый ватт и снижает задержку в 1,7–3,6 раза. Таким образом, Jalapeño демонстрирует значительное улучшение производительности и скорости обработки данных.
Для более интерактивных задач производительность Jalapeño увеличилась в 2,1–4,1 раза. OpenAI планирует внедрить этот чип в своем оборудовании к концу 2026 года, что позволит улучшить их инфраструктуру. Тестирование чипа проводилось с использованием бенчмарка InferenceX от SemiAnalysis, который оценивает пропускную способность и задержку.
Разработка чипа Jalapeño не обошлась без помощи ИИ. OpenAI использовала свои нейросети для оптимизации проектирования и производства чипа, что позволило сократить время разработки до девяти месяцев. С помощью Codex на базе GPT-Astra были ускорены отдельные блоки моделей, что увеличило их производительность в 1,5–1,8 раза.
Jalapeño стал частью новой интегрированной инфраструктуры OpenAI, включающей дата-центры и программное обеспечение. По словам финансового директора Сары Фрайар, собственный чип дает больше контроля над затратами и позволяет выбирать оборудование для конкретных задач. OpenAI продолжит использовать процессоры партнеров, таких как Microsoft и Nvidia, для различных этапов работы.
Экономическая стратегия OpenAI направлена на снижение стоимости вычислительных процессов. Компания ожидает, что повышение эффективности оборудования приведет к увеличению числа обрабатываемых запросов и улучшению доходности. Кроме того, OpenAI уже работает над вторым и третьим поколениями своих процессоров, что подтверждает их нацеленность на дальнейшее развитие.