OpenAI опубликовала system card GPT-5.3 Instant — новой быстрой модели в линейке GPT-5. Основной акцент — скорость ответа, более уместная работа с веб-поиском и более плавный диалог без лишних оговорок. Но по части безопасности и медицинских сценариев результаты получились неоднозначными: по ряду чувствительных категорий модель уступает GPT-5.2 Instant.
Главное:
— упор на быстрый ответ и более удобный диалог
— подход к safety-митигациям в целом остался тем же, что у GPT-5.2 Instant
— на Production Benchmarks модель в среднем лучше GPT-5.1 Instant, но хуже GPT-5.2 Instant
— sexual content: 0.866 против 0.926 у GPT-5.2 Instant
— self-harm: 0.895 против 0.923
— graphic violence: 0.781 против 0.852
— nonviolent illicit behavior: 0.921 против 0.832
— в многоходовых тестах: mental health — 0.985, emotional reliance — 0.992, self-harm — 0.911
— на HealthBench: 54.1% против 55.4% у GPT-5.2 Instant
— на HealthBench Hard: 25.9% против 26.8%
— на HealthBench Consensus: 95.3% против 95.8%
— модель лучше запрашивает недостающий контекст: +4.4%
— аккуратнее формулирует ответы при неопределенности: +4.0%
— хуже собирает контекст перед направлением к специалисту: -10.1%
— слабее учитывает локальный медицинский контекст: -5.5%
Что это значит
GPT-5.3 Instant стала удобнее для массовых диалоговых сценариев, но улучшения распределены неравномерно. Скорость и плавность общения выросли, а по safety и медицине есть локальные ухудшения относительно GPT-5.2 Instant.
Для разработчиков вывод простой: модель подходит для быстрых диалогов и веб-сценариев, но в темах self-harm, sexual content и медицинских советов ей нужен более жесткий контроль и дополнительные защитные слои.