OpenAI показала первые результаты своего inference-чипа Jalapeño - и он обходит NVIDIA GB200/GB300 по ключевым метрикам.

OpenAI показала первые результаты своего inference-чипа Jalapeño - и он обходит NVIDIA GB200/GB300 по ключевым метрикам.

В тестах на GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T:

- в 1,5-1,9× выше производительность на ватт

- в 1,7-3,6× ниже end-to-end latency

- до 4,1× выше скорость в интерактивных сценариях

- до 1459 токенов/с на пользователя на GPT-OSS 120B

- до 700 токенов/с на DeepSeek R1

TDP Jalapeño - 700 Вт, но в тестах потребление не превышало 550 Вт.

OpenAI планирует начать развёртывание чипа до конца 2026 года. Gen 2 уже в разработке, Gen 3 формируется.