GPT-5.3-Codex-Spark — модель для мгновенной работы с кодом - AI Founder

GPT-5.3-Codex-Spark — модель для мгновенной работы с кодом

OpenAI выпустила GPT-5.3-Codex-Spark — облегчённую версию GPT-5.3-Codex для интерактивной разработки. Модель оптимизирована под минимальную задержку и выдаёт более 1000 токенов в секунду. Работает на ускорителях Cerebras.

Что изменилось

  • Скорость. Модель вносит точечные правки и не запускает тесты без запроса.

  • Контекст — 128K токенов. Подходит для крупных файлов и проектов.

  • Меньше задержек:
    – на 80% меньше клиент-серверных накладных расходов
    – на 30% меньше затрат на токен
    – на 50% быстрее первый токен
    Используется постоянное WebSocket-соединение.

  • Аппаратная база. Инференс на Cerebras WSE-3; GPU остаются основной платформой для массовых задач.

  • Бенчмарки. На SWE-Bench Pro и Terminal-Bench 2.0 модель решает задачи быстрее GPT-5.3-Codex без потери точности.

Зачем это нужно

Теперь в Codex есть два режима: автономные агентные задачи и мгновенная итерация. Узким местом становится не интеллект модели, а скорость взаимодействия — и Spark сокращает этот разрыв.

Если подход приживётся, низкая задержка станет стандартом для инструментов разработки.

Максим Черняк
Автор: Максим Черняк

Эксперт AI Founder. Слежу за последними новостями в мире искусственного интеллекта.

Подпишись на наш Telegram-канал

чтобы не упустить главные AI-новости

Подписаться
0
Оставьте комментарий! Напишите, что думаете по поводу статьи.x