OpenAI показала первые результаты своего inference-чипа Jalapeño - и он обходит NVIDIA GB200/GB300 по ключевым метрикам.
В тестах на GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T:
- в 1,5-1,9× выше производительность на ватт
- в 1,7-3,6× ниже end-to-end latency
- до 4,1× выше скорость в интерактивных сценариях
- до 1459 токенов/с на пользователя на GPT-OSS 120B
- до 700 токенов/с на DeepSeek R1
TDP Jalapeño - 700 Вт, но в тестах потребление не превышало 550 Вт.
OpenAI планирует начать развёртывание чипа до конца 2026 года. Gen 2 уже в разработке, Gen 3 формируется.