(Вчера), Редакция Рунет | 👁 804

OpenAI показала превосходство своего ИИ-процессора Jalapeno над ускорителями Nvidia по производительности на ватт

Компания OpenAI раскрыла новые подробности о своём ИИ-процессоре Jalapeno, разработанном с помощью Broadcom и Celestica. Разработка превосходит продукты Nvidia по показателям производительности.

«Согласно результатам внутренних тестов, Jalapeno является самым эффективным чипом для задач инференции», — сообщает IXBT News.

Jalapeno содержит один вычислительный кристалл размером с фотошаблон, произведённый по техпроцессу TSMC N3P. На подложке также имеется чиплет ввода-вывода и память HBM4, обеспечивающая пропускную способность 15,4 ТБ/с на стек. Вычислительные ядра и память разделены на блоки, что обеспечивает каждому блоку ядра локальное представление с низкой задержкой о назначенном ему блоке HBM.

Вместо стандартных 16-битных или 8-битных форматов Jalapeno использует числовые форматы MXFP, которые дополнительно сжимают данные для математических вычислений ИИ до 4 бит в MXFP4. В матричном процессоре Jalapeno используется систолическая матрица с неподвижным весом. Данные поступают в сетку тесно связанных между собой обрабатывающих ячеек, передаваясь напрямую от одной ячейки к другой без постоянных остановок для чтения/записи во внешнюю память.

В бенчмарке InferenceX процессор показал в 1,5–1,9 раза большую производительность на ватт при пиковой пропускной способности и в 1,7–3,6 раза меньшую сквозную задержку, чем Nvidia GB200/GB300. Это основано на тестировании моделей OpenAI GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T. Официальное потребление составляет 700 Вт, но под нагрузкой процессор реально потребляет около 550 Вт.

Чип не оптимизирован специально для какого-либо одного семейства моделей и может запускать любую модель.

Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.

Комментарии 0
Зарегистрируйтесь или , чтобы оставлять комментарии.
Читайте нас в удобном формате: