OpenAI выпустила GPT-5.3-Codex-Spark — облегчённую версию GPT-5.3-Codex для интерактивной разработки. Модель оптимизирована под минимальную задержку и выдаёт более 1000 токенов в секунду. Работает на ускорителях Cerebras.
Что изменилось
-
Скорость. Модель вносит точечные правки и не запускает тесты без запроса.
-
Контекст — 128K токенов. Подходит для крупных файлов и проектов.
-
Меньше задержек:
– на 80% меньше клиент-серверных накладных расходов
– на 30% меньше затрат на токен
– на 50% быстрее первый токен
Используется постоянное WebSocket-соединение. -
Аппаратная база. Инференс на Cerebras WSE-3; GPU остаются основной платформой для массовых задач.
-
Бенчмарки. На SWE-Bench Pro и Terminal-Bench 2.0 модель решает задачи быстрее GPT-5.3-Codex без потери точности.
Зачем это нужно
Теперь в Codex есть два режима: автономные агентные задачи и мгновенная итерация. Узким местом становится не интеллект модели, а скорость взаимодействия — и Spark сокращает этот разрыв.
Если подход приживётся, низкая задержка станет стандартом для инструментов разработки.