OpenAI выпустила ChatGPT Images 2.0 и делает акцент на том, что это уже не просто “картинка по промпту”, а более умный визуальный инструмент для реальных задач. Модель лучше следует сложным инструкциям, аккуратнее размещает объекты в кадре, увереннее работает с мелким текстом, UI-элементами и плотными композициями.
Из ключевых улучшений — более точная генерация текста внутри изображения, лучшая работа с неанглийскими языками, более сильный фотореализм и заметно более уверенные стилизации под кино, пиксель-арт, мангу и другие форматы. Плюс теперь поддерживаются разные aspect ratio — от очень широких до вертикальных.
Главное нововведение — “thinking” для изображений. В этом режиме модель может искать актуальную информацию в интернете, делать несколько разных вариантов из одного запроса, перепроверять результат и даже собирать рабочие QR-коды. То есть она берет на себя больше работы между идеей и готовым визуалом.
ChatGPT Images 2.0 уже доступна пользователям ChatGPT и Codex, а модель gpt-image-2 появилась и в API.