OpenAI представила первые результаты Jalapeño — собственного специализированного чипа для инференса ИИ. В тестах на GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T он обеспечил в 1,5–1,9 раза больше вычислительной работы на ватт и в 1,7–3,6 раза меньшую сквозную задержку по сравнению с системами на GB200 и GB300. Для интерактивных нагрузок скорость генерации на пользователя выросла в 2,1–4,1 раза.
Номинальная мощность Jalapeño составляет 700 Вт, а в тестах устойчивое потребление не превышало 550 Вт. Чип проектировали с помощью моделей OpenAI, а Codex с GPT-Astra помог оптимизировать поддержку трех моделей с открытыми весами за два месяца. Развертывание Jalapeño в инфраструктуре OpenAI планируется начать до конца 2026 года.