Сначала кадр, потом видео
Keyframe-first workflow · 先生图再生视频
Сначала генерируют картинку — первый кадр будущего ролика — и утверждают по ней героя, костюм и композицию, а потом оживляют её в видеомодели. Сложная сцена так не разваливается, а лицо и место заданы заранее.
Параметры кадра
- Кадр
- в том же формате, что видео (16:9 или 9:16)
- Разрешение
- не ниже видео, от 1920×1080
- Движение
- 1–2 действия на шот
- Длительность
- 5–8 с от одного кадра
- Старт движения
- плавный, без рывка в первые 0,5 с
start from an approved keyframe: animate this first frame, keep the character, outfit and composition exactly as in the image, only add the described motion
从确认好的首帧开始:让这张首帧动起来,人物、服装和构图与图片完全一致,只添加描述的动作
Целый промт с этим приёмом открыт участникам клуба. Открыть доступ
Уровень: средний — нужно 2–3 условия в промте. Как вставить: сначала своими словами опишите сцену — кто в кадре, где, что делает, — потом добавьте фразу целиком, не переводя. Обе фразы сразу не нужны.
Что это
Видеомодель, получившая только текст, сама придумывает лицо, костюм, свет и композицию — и каждый раз по-новому. Здесь работу делят на два шага. Сначала в генераторе картинок (GPT Image, Seedream) делают ключевой кадр — первый кадр будущего ролика — и правят его, пока не устроят лицо, одежда, место и крупность. Потом картинку загружают в видеомодель стартовым кадром (режим image-to-video, «картинка в видео»), и промт описывает уже в основном движение. Так не разваливаются сложные сцены: бой, исторический костюм, продукт в рекламе. Если кадр нужен из готовой раскадровки, его заново генерируют отдельной картинкой в полном размере: вырезанная клетка слишком мелкая. От «Раскадровки одним листом» отличается ролью картинки: здесь одна картинка становится первым кадром ролика, а там сетка из 6–9 кадров идёт в модель образцом порядка планов.
Когда брать
- Исторический или фантастический костюм, который модель не угадает по тексту
- Реклама: продукт должен выглядеть ровно как на утверждённой картинке
- Бой или трюк, где важна поза в первую секунду
- Серия шотов с одним героем: у каждого шота свой утверждённый первый кадр
Как написать в промте
Делайте кадр в том же соотношении сторон и не меньше разрешения видео: для 16:9 — от 1920×1080. Промт пишите про движение, а место и героя называйте не больше чем одной строкой и теми же словами, что в промте картинки: «animate the provided first frame: she pulls the press bar, slow push-in», плюс «keep face, costume and composition exactly as in the image». Если текст и картинка расходятся, Seedance начинает менять героя. Одно-два действия и один ход камеры на шот 5–8 с. Резкое движение в первые полсекунды Kling часто отрывает от картинки и дорисовывает лицо заново — начинайте медленно. Мелкие надписи уберите ещё на картинке: в движении они расползаются.
Частые ошибки
- Кадр другого формата, чем видео, — модель обрезает или дорисовывает края
- Промт заново описывает героя не так, как на картинке, — лицо меняется
- Резкое движение с первой секунды — видео отрывается от кадра
- Мелкие надписи на картинке — в движении они расползаются
Ещё называют
Image-first, First frame, Start frame, 首帧生成
В редактор уйдёт только фраза приёма — допишите перед ней, кто в кадре и где