OpenAI выпустила ChatGPT Images 2.5 — обновлённую модель для генерации и редактирования изображений в ChatGPT. Компания заявляет, что модель генерирует изображения до 50% быстрее предыдущей версии, лучше сохраняет внешность людей и животных и точнее удерживает детали после нескольких последовательных правок.
ChatGPT Images 2.5 уже доступна в веб-версии. Позже она появится в мобильных и десктопных приложениях. Обновление получили пользователи всех тарифов ChatGPT. Детали в материале Postium.
Читайте также: 25 нейросетей для генерации изображений
Что нового в ChatGPT Images 2.5?
Одно из главных изменений касается редактирования готовых изображений. Пользователь может указать конкретную область картинки и написать комментарий с нужной правкой. Модель должна изменить выбранный фрагмент и сохранить остальные детали изображения. Раньше последовательные правки могли менять внешность персонажа, фон или другие элементы, которых пользователь не просил касаться.
ChatGPT Images 2.5 также лучше сохраняет узнаваемые черты людей и животных. OpenAI отдельно заявляет о более естественном освещении, текстурах и деталях изображения. Генерация при этом занимает до 50% меньше времени по сравнению с Images 2.0.
В интерфейсе появился инструмент Sketch. Пользователь может нарисовать форму или схему прямо поверх изображения и показать модели, где разместить объект или как изменить композицию. Для части задач это заменяет длинное текстовое описание: например, можно набросать расположение объекта и попросить ChatGPT превратить рисунок в готовый элемент изображения. Также OpenAI добавила шаблоны для постеров, мерча и других типовых макетов.
Как пользоваться
В ChatGPT можно создавать изображения прежним способом — описать нужную картинку текстом. Если нужно изменить готовый результат, пользователь может оставить комментарий на конкретной области изображения и написать, что именно там поменять.
Для правок через рисунок можно вызвать Sketch и отметить нужное изменение непосредственно на изображении. Например, нарисовать место для нового объекта, указать его форму или обозначить расположение текста. После этого ChatGPT использует набросок вместе с текстовым запросом.
В API появились GPT-Image-2.5 Flare и GPT-Image-2.5 Sunburst. Flare ориентирована на более быструю генерацию и получила те же основные улучшения качества и редактирования, что ChatGPT Images 2.5. Sunburst рассчитана на задачи, где важнее точность и детализация, но генерация занимает больше времени.
Почему это важно? Основное изменение касается не первоначальной генерации, а дальнейшей работы с изображением. Пользователь может последовательно править отдельные детали и реже получать полностью изменённую картинку после локальной команды. Это особенно заметно при работе с персонажами, фотографиями, макетами и изображениями, которые проходят несколько итераций.
Наброски и комментарии также дают способ показать изменение визуально, когда его сложно точно описать текстом: указать положение объекта, область правки или примерную форму прямо на изображении.
Итог: ChatGPT Images 2.5 сокращает время генерации и добавляет более точечное редактирование: пользователь может менять отдельные части изображения комментариями и набросками, сохраняя остальные элементы между итерациями.



