Автор сначала создал референс взрослого ботаника: каштановые кудрявые волосы, одна белая прядь, зелёные глаза, родинка на щеке, жёлтый шарф и тёмно-синий пиджак. В исходной инструкции была ещё маленькая выемка в брови, но на готовой картинке она читалась плохо, а родинка оказалась с другой стороны. Поэтому дальше ориентировались на то, что реально видно в изображении.

Исходник дважды отправили в новые чаты ChatGPT с одинаковым промптом. Модель должна была повернуть персонажа примерно на 45 градусов, сохранив одежду, причёску, стиль и фон. В обоих случаях получился диагональный профиль, где остались обе глаза, белая прядь, зелёные радужки, родинка и другие узнаваемые детали.

Затем каждый из двух профильных кадров вернули в анфас двумя способами. В первом варианте ChatGPT видел только изображение из профиля. Во втором к нему добавляли первоначальный портрет и отдельно указывали использовать его как референс лица. Всего получили четыре результата. Во всех сохранились белая прядь, зелёные глаза, родинка, жёлтый шарф и тёмно-синий пиджак.

Но точной копии исходного лица не вышло. Менялись линия волос, контуры лица и складки шарфа. Кадры с повторно загруженным оригиналом не выглядели явно ближе к нему, чем результаты только по профильному изображению. Думаю, причина простая: ключевые приметы не потерялись при повороте, поэтому одной промежуточной картинки модели уже хватило. Короче, персонаж узнаваем, но детали при таком круговом маршруте всё равно плывут.

Вывод для последовательных генераций практичный. Сначала проверяйте, остались ли на промежуточном кадре идентификаторы героя — белая прядь, родинка, цвет глаз и одежда. Если нужно лишь сохранить того же персонажа, этого может хватить. А когда важна точность исходника, сравнивайте новый кадр с оригиналом отдельно: узнаваемость и совпадение мелких деталей — разные проверки.

Главное

  • - ChatGPT в веб-версии вернул персонажа из диагонального профиля в почти фронтальный ракурс
  • - Повторная загрузка исходного портрета не дала явно более точного лица
  • - Белая прядь, зелёные глаза, родинка и одежда сохранились во всех четырёх результатах
  • - Волосы, контуры лица и складки шарфа заметно отличались от первой картинки
  • - Для сохранения идентичности хватило промежуточного кадра, где ключевые приметы не скрылись

Источник: note #画像生成AI (креаторы)