OpenAI и Broadcom представили Jalapeño — чип для быстрой работы AI-моделей. Он нужен, чтобы ChatGPT, Codex, API и будущие AI-сервисы отвечали быстрее, стабильнее и дешевле при большом числе пользователей.
Jalapeño — это не универсальный процессор, а ускоритель для LLM inference. Так называют этап, когда модель уже обучена и отвечает пользователю.
Чип разработали OpenAI, Broadcom и Celestica. OpenAI отвечала за архитектуру под свои модели и сервисы, Broadcom — за silicon, networking и производство, Celestica — за платы, стойки и системную интеграцию.
Компании заявляют, что первые тесты показывают лучшую performance per watt, чем у текущих решений. Это значит: больше AI-ответов при меньшем расходе энергии.
Jalapeño будут использовать в data centers. Развертывание планируют начать к концу 2026 года вместе с партнерами, включая Microsoft.