OpenAI выпустила GPT-5.3-Codex-Spark. Это исследовательская версия модели. Она создана для одной цели — скорости.
Модель работает в пятнадцать раз быстрее флагманского GPT-5.3 Codex. Она выдает более тысячи токенов в секунду. Задержка между мыслью и кодом исчезает.
Секрет скорости — в железе. Модель работает на чипе Cerebras WSE-3. Это целая кремниевая пластина.
Чип размером с пластину. Модель целиком помещается на нем. Нет проводов, нет узких мест.
Программная часть тоже переделана. Используется постоянное соединение WebSocket. Это снижает задержки на восемьдесят процентов.
Код появляется почти сразу после нажатия Enter. Можно прервать модель на полуслове. И перенаправить ее логику.
За скорость пришлось заплатить. У модели меньшая глубина рассуждений. Она проигрывает в сложных тестах.
Ее не стоит использовать для задач безопасности. Флагманская модель справляется с этим лучше. У нее выше рейтинг.
Модель уже доступна пользователям ChatGPT Pro. Ее можно выбрать в приложении Codex. Или в расширении для VS Code.
Это первый опыт OpenAI с Cerebras. Раньше они использовали кластеры NVIDIA. Теперь пробуют новое железо.