OpenAI заявляет: ChatGPT Images 2.5 генерирует изображения с задержкой до 50% меньше, чем Images 2.0. Для креатора важна и другая перемена — модель должна лучше сохранять лицо, фон и композицию, если попросить изменить одну деталь. Японская команда EeeeAI показала это на коте: кривой набросок превратился почти в фотографию.
В видео технический директор EeeeAI 小木曽 объясняет обновление начинающему пользователю 太田和. Они рисуют, получают изображение и затем просят изменить отдельные части. Такой процесс пригодится тем, кто делает обложки, превью или кадры для шортсов: можно продолжать работу с удачным исходником, а не начинать заново после каждой правки.
Что изменилось в ChatGPT Images 2.5
OpenAI сравнивает скорость с Images 2.0 и говорит о сокращении задержки до 50%. Это максимальное значение, а не обещание, что каждый запрос будет выполняться ровно вдвое быстрее. Зато варианты можно получать быстрее и чаще проверять идеи — особенно когда задача требует нескольких итераций.
Ещё одно обновление — точечное редактирование. По описанию OpenAI, Images 2.5 лучше меняет то, о чём попросили, и сохраняет остальное. Например, при смене цвета одежды или надписи модель должна реже менять лицо и фон. Последовательные правки тоже должны лучше сохранять результаты предыдущих шагов и качество картинки.
В обзоре модели Virse описало независимый тест на пять раундов правок. Images 2.5 меняла примерно 18% пикселей за одну правку, предыдущая версия — около 60%. Это результат конкретного теста, а не универсальный бенчмарк. Но он показывает, почему важно смотреть не только на первую генерацию: иногда главное — сколько правок потребуется до пригодного результата.
Как Sketch помогает перейти от наброска к кадру
В демонстрации EeeeAI 小木曽 нарисовал кота от руки. Сам автор сравнил рисунок с инопланетянином, и участники видео засмеялись. К наброску добавили описание сцены: кот загорает у окна. ChatGPT превратил простые линии в изображение, похожее на фотографию.
Потом автор добавлял детали через комментарии на изображении. В одной версии кот оказался в соломенной шляпе. В финальной он задрал подбородок с выражением, которое по-японски назвали «ドヤ顔» — самодовольная, победная морда. Вечерний морской пейзаж всё ещё выглядел немного искусственно. Проверять результат глазами всё равно придётся.
«Можно просто нарисовать один круг» — совет 小木曽 тем, кто не знает, с чего начать.
Sketch помогает визуальному автору быстро объяснить композицию. Наметьте, где находится персонаж, куда он смотрит и что стоит рядом. Такая схема может передать задумку понятнее, чем длинное описание.
Как редактировать картинку, не пересобирая её с нуля
Ситуация знакомая: просите поменять надпись, а меняются фон и шрифт. Поправляете цвет одежды — и лицо становится другим. В японском видео 太田和 спросил, должна ли новая версия уменьшить такие сбои. 小木曽 ответил: «Именно так».
Я бы выстраивал работу так: сначала зафиксировать композицию и выбрать удачный исходник, потом менять детали по одной. Для локальной правки можно использовать комментарий на изображении или инструмент выделения, если он доступен в интерфейсе. После каждого шага проверяйте весь кадр. Не поплыло ли лицо? Не исчезла нужная деталь? Текст всё ещё читается?
Для обложки или превью такой подход может сократить число перегенераций. Сначала утвердите расположение объекта и свободное место под надпись. Потом отдельно поправьте цвет или небольшой элемент. Для серии изображений можно оставить общий референс и сравнивать, насколько узнаваемыми остались персонаж и стиль. Единства серии это не гарантирует, зато помогает следить за изменениями.
Если нужно точно отрендерить текст или сохранить сложный макет, в карточке новости указаны варианты для API: Flare для быстрых итераций и Sunburst для точной работы со сложными макетами. В самом ChatGPT модель, согласно карточке, выбирается автоматически. Вручную выбрать вариант можно через API. Это пригодится тем, кто подключает генерацию к своему рабочему процессу.
Ограничения, доступ и цена
Улучшенное редактирование не гарантирует, что модель сохранит всё за пределами выделенной области. В японской статье со ссылкой на справку OpenAI отмечено: модель может неточно понять выделение и затронуть соседние участки. Проверяйте весь кадр после правки и сохраняйте важные версии отдельно.
EeeeAI пишет, что Images 2.5 доступна во всех планах ChatGPT, в том числе бесплатном, и на компьютере, смартфоне и в браузере. В предоставленных материалах независимо подтвердить эту информацию не удалось. Перед рабочим проектом проверьте, какие функции доступны в вашем аккаунте. Цен в японском разборе нет: там не указана стоимость подписки или отдельная плата за генерацию.
Похоже, обновление должно сократить потери между первой удачной картинкой и финалом. Sketch помогает показать идею линиями, комментарии — указать место правки, а более стабильное редактирование — реже менять половину кадра вместе с одной деталью. Но результат всё равно нужно проверять глазами.
Промты для генерации и редактирования изображений — в библиотеке
Источники
Introducing GPT Images 2.5 in the API and ChatGPT — OpenAI Developer Community
GPT Image 2.5 Review: Does It Finally Fix AI Image Editing Drift?
OpenAI Launches ChatGPT Images 2.5 with Sharper Details
What Is GPT Image 2.5? Sunburst and Flare
Источникnote.com
