При создании короткого AI-видео с двумя людьми автор столкнулся с обычной проблемой: если в одном длинном промпте смешать персонажей, фон, композицию и движения, потом непонятно, что именно менять. Поэтому он решил разделить описание на статичную сцену для изображения и отдельное описание действий для видео.

В сценическом промпте не должно быть изменений во времени. Туда попадает только то, что остаётся неизменным в кадре: два разных исполнителя слева и справа, матовая оранжевая бесшовная студия, один подвесной микрофон по центру, мягкий свет и кадрирование по пояс. Движения предлагается описывать отдельно — уже на этапе генерации видео.

Подход выглядит прям практично для итераций. Если нужно поправить фон, расположение объектов или композицию, вы редактируете сцену. Если проблема в поведении персонажей или динамике кадра — меняете блок движения, не трогая остальное. Автор проверяет, помогает ли такое разделение лучше контролировать image-to-video.

Пока в материале показан сам принцип и пример сценического промпта. Это не готовая универсальная формула, а рабочий способ разложить задачу на две части и не искать нужную правку внутри одного огромного описания.

Главное

  • - Сценический промпт описывает только неизменные элементы кадра
  • - Движения и изменения во времени выносятся в отдельный промпт
  • - В примере: два исполнителя, оранжевая студия и микрофон по центру
  • - Разделение упрощает правки фона, композиции и действий
  • - Подход проверяют на коротких AI-видео с двумя персонажами

Источник: Zenn 生成AI