OpenAI показала превосходство своего ИИ-процессора Jalapeno над ускорителями Nvidia по производительности на ватт
Компания OpenAI раскрыла новые подробности о своём ИИ-процессоре Jalapeno, разработанном с помощью Broadcom и Celestica. Разработка превосходит продукты Nvidia по показателям производительности.
«Согласно результатам внутренних тестов, Jalapeno является самым эффективным чипом для задач инференции», — сообщает IXBT News.
Jalapeno содержит один вычислительный кристалл размером с фотошаблон, произведённый по техпроцессу TSMC N3P. На подложке также имеется чиплет ввода-вывода и память HBM4, обеспечивающая пропускную способность 15,4 ТБ/с на стек. Вычислительные ядра и память разделены на блоки, что обеспечивает каждому блоку ядра локальное представление с низкой задержкой о назначенном ему блоке HBM.
Вместо стандартных 16-битных или 8-битных форматов Jalapeno использует числовые форматы MXFP, которые дополнительно сжимают данные для математических вычислений ИИ до 4 бит в MXFP4. В матричном процессоре Jalapeno используется систолическая матрица с неподвижным весом. Данные поступают в сетку тесно связанных между собой обрабатывающих ячеек, передаваясь напрямую от одной ячейки к другой без постоянных остановок для чтения/записи во внешнюю память.
В бенчмарке InferenceX процессор показал в 1,5–1,9 раза большую производительность на ватт при пиковой пропускной способности и в 1,7–3,6 раза меньшую сквозную задержку, чем Nvidia GB200/GB300. Это основано на тестировании моделей OpenAI GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T. Официальное потребление составляет 700 Вт, но под нагрузкой процессор реально потребляет около 550 Вт.
Чип не оптимизирован специально для какого-либо одного семейства моделей и может запускать любую модель.
Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.