Японский автор предлагает собирать ИИ-аниме по шагам: сначала разделить сценарий на сцены и кадры, затем написать промты для видеомодели. Так у генерации появляется понятный план — действия, ракурсы и реакции персонажей.

В гайде на note автор сравнивает сцену со страницей манги, а кадр — с отдельной панелью. Сценарий, по его словам, можно написать «как получится». Главное — заранее прикинуть число кадров и представить, укладывается ли сцена примерно в 10 секунд. Это авторский ориентир для планирования, не технический лимит генераторов.

Экран видеоредактора с аниме-кадрами и кнопкой Generate Video рядом с персонажем, что связано с созданием аниме с помощью ИИ.Источник: note.com

Как сделать ИИ-аниме: сначала сцены и раскадровка

Первый AI-агент работает как режиссёр раскадровки. Он получает сценарий и делит его на кадры: задаёт роль каждого, длительность, композицию, движение камеры, персонажей, свет и смену эмоций. В инструкции автора есть и конкретные рамки: кадр обычно длится 2–5 секунд, максимум — 8 секунд. В одном плане не стоит совмещать действия, которые трудно показать одновременно.

В примере Хината влетает в комнату к Элизабет. Автор задаёт средний план через плечо Элизабет: дверь видна на заднем плане, камера быстро переводит фокус на Хинату. Элизабет в этот момент замирает с чашкой в руке. Получается несколько конкретных решений вместо общего описания «девушка входит».

Такой план пригодится и для рекламного ролика, и для короткого скетча. Ещё до генерации видно, если в трёхсекундный кадр набилось слишком много действий: дверь распахивается, героиня бежит, другая оборачивается и реагирует. Модель может слить всё в одну размытую сцену. Разбейте движение по времени или уберите один жест. Тогда результат будет проще оценить.

Инструкция для первого агента задаёт формат раскадровки: там есть идентификаторы сцены и кадра, реплики, звук и режиссёрский замысел. Шаблон можно скопировать в LLM и адаптировать под свой сценарий. Сохраните проверку хронометража и выполнимости сцены: длинная мизансцена в короткий клип обычно не помещается.

Ниже фрагмент шаблона, который задаёт формат раскадровки. Перед использованием настройте общие правила под свой жанр и длительность. Проверку хронометража и согласованности действий лучше оставить.

ПромтяпонскийФрагмент шаблона из японского гайда; инструкция для AI-агента, который готовит промты для Google Omni или Grok Imagine. Оригинал и.
### 【Scene [シーンID] - Cut [カットID]】
- **カット尺**: [秒数]
- **カットの役割**: [役割]

#### 1. Video Prompt (For Google Omni / Grok Imagine)
Скопируйте и вставьте в нейросеть как есть, на японском: переводить не нужно.

Второй агент превращает раскадровку в промт для видео

Готовый кадр передают второму агенту. Тот сохраняет композицию, порядок действий и направление взгляда, а затем описывает движение для видеомодели. Автор делит результат на основной Video Prompt, Camera Motion, Negative Prompt и заметки для постпродакшна.

В примере с Хинатой заданы стиль 2D-аниме, средний план через плечо, внешний вид героев, последовательность действий и дневной свет. Камеру автор описывает отдельно: лёгкая ручная дрожь и быстрый перевод фокуса. В negative prompt перечислены нежелательные варианты, например фотореализм и взгляд персонажа прямо в камеру.

Разделение на этапы помогает держать сцену под контролем. Если заранее не определить композицию и хронометраж, языковая модель может каждый раз по-своему додумывать детали. В длинном запросе описания стиля, персонажей и света тоже легко заслоняют действие.

Ниже — дословный пример основного промта из гайда. Для своих героев меняйте внешность, одежду, место действия и поступки. Имена и описания персонажей при этом должны совпадать во всех сценах.

ПромтанглийскийПример Video Prompt из японского гайда для Google Omni или Grok Imagine. Английский оригинал; заменить описание персонажей и сцены.
[Style]: 2D Japanese anime style, high-quality modern cel-shaded animation, crisp lineart, vibrant colors, cinematic screencap.
[Shot & Camera]: Medium shot, over-the-shoulder framing from behind Elizabeth's back in the foreground left, looking towards the open doorway in the background right. Focus swiftly racks from Elizabeth's back to Hinata.
[Subject & Character]: Elizabeth [young Victorian noble lady, blonde hair, ornate dress seen from behind] sitting still. Hinata [energetic teenage girl, short brown hair, yellow hoodie, breathless desperate expression, looking urgently forward].
[Action & Motion]: Starts with the background door violently swinging wide open; Hinata bursts into the room, leaning forward and dashing towards Elizabeth. Simultaneously, Elizabeth's hand holding a teacup freezes mid-air, slightly turning her head in annoyance.
[Lighting & Background]: Sunlit European-style classic study room, soft natural afternoon sunlight pouring through tall arched windows, subtle dust motes floating.
Скопируйте и вставьте в нейросеть как есть, на английском: переводить не нужно.
Из чего собран промт
  1. стильстиль: 2D аниме, сел-шейдинг, яркие цвета[Style]: 2D Japanese anime style, high-quality modern cel-shaded animation, crisp lineart, vibrant colors, cinematic screencap.
  2. ракурсракурс: средний план, из-за спины, фокус на дверь[Shot & Camera]: Medium shot, over-the-shoulder framing from behind Elizabeth's back in the foreground left, looking towards the open doorway in the background right. Focus swiftly racks from Elizabeth's back to Hinata.
  3. персонажиперсонажи: Элизабет и Хината, описание[Subject & Character]: Elizabeth [young Victorian noble lady, blonde hair, ornate dress seen from behind] sitting still. Hinata [energetic teenage girl, short brown hair, yellow hoodie, breathless desperate expression, looking urgently forward].
  4. действиедействие: дверь открывается, Хината вбегает[Action & Motion]: Starts with the background door violently swinging wide open; Hinata bursts into the room, leaning forward and dashing towards Elizabeth. Simultaneously, Elizabeth's hand holding a teacup freezes mid-air, slightly turning her head in annoyance.
  5. светфон: солнечная комната, мягкий свет[Lighting & Background]: Sunlit European-style classic study room, soft natural afternoon sunlight pouring through tall arched windows, subtle dust motes floating.

В инструкции отдельно описано движение камеры. Используйте этот блок, если модель принимает настройки камеры отдельно от основного описания. Если такого поля нет, добавьте нужное движение в основной промт, не повторяя его разными словами.

ПромтанглийскийCamera Motion для сцены с Хинатой и Элизабет; оригинал.
Static camera framing with organic subtle handheld micro-shake. Quick rack-focus shift from foreground left to background right as the door opens.
Скопируйте и вставьте в нейросеть как есть, на английском: переводить не нужно.
Из чего собран промт
  1. камерастатичная камера с микровибрациейStatic camera framing with organic subtle handheld micro-shake.
  2. камерабыстрый перевод фокусаQuick rack-focus shift from foreground left to background right as the door opens.

В примере negative prompt ограничивает стилизацию, ошибки анатомии и прямой взгляд в камеру. Состав списка зависит от модели. Если отдельного поля negative prompt нет, проверьте инструкцию сервиса и перенесите ограничения в поддерживаемый формат.

ПромтанглийскийNegative Prompt из примера в гайде; английский оригинал, если выбранная модель поддерживает отдельное поле.
3D CGI, photorealistic, deformed anatomy, bad hands, looking directly at viewer, motionless frame, distorted face, flickering lines, blurry foreground subject blocking the view awkwardly.
Скопируйте и вставьте в нейросеть как есть, на английском: переводить не нужно.
Из чего собран промт
  1. негативизбегать 3D CGI3D CGI, photorealistic,
  2. негативизбегать деформированную анатомиюdeformed anatomy, bad hands,
  3. негативизбегать взгляд в камеруlooking directly at viewer, motionless frame,
  4. негативизбегать искаженное лицоdistorted face, flickering lines,
  5. негативизбегать размытый передний планblurry foreground subject blocking the view awkwardly.

Где генерировать клипы и что известно о лимитах

В гайде автор упоминает Google Flow и Grok Imagine для создания персонажей, а затем предлагает подставлять их в сцены и собирать клипы в Canva или Google Vids. Это маршрут из его статьи. Функции референсов персонажей и их работу в каждом сервисе проверяйте в интерфейсе: доступные материалы не подтверждают все детали.

О генерации видео в Google Vids есть свежая официальная информация. Google объявила, что сервис использует Gemini Omni 1.1 Flash; доступ обещают пользователям с аккаунтом Google, а создание клипов — бесплатным. Компания указывает генерацию и апскейл до 1080p, точную настройку длительности и продление сцен с сохранением визуальной последовательности. Начать предлагают на компьютере через vids.new. Эти условия относятся к Vids, не к бесплатному доступу к Gemini API.

В документации Google Gemini Omni Flash описана как модель для генерации и редактирования видео. Она также работает с текстом, изображениями, аудио и видео; редактировать ролики можно запросами на обычном языке. Максимальную длительность клипа официальные материалы не называют. Поэтому 10 секунд, указанные в японском посте для Gemini, остаются ориентиром автора.

В документации xAI для Imagine API указана генерация видео в разрешениях 480p, 720p и 1080p. Цена начинается от $0.02 за секунду. Это стоимость API, а не обязательно работы через пользовательский интерфейс Grok. Упомянутый автором лимит в 15 секунд доступная документация не подтверждает.

Длительность сцены около 10 секунд в японском гайде — ориентир автора. Перед раскладкой сценария проверьте фактический лимит клипа в выбранном интерфейсе.

Как адаптировать пайплайн под свой ролик

Я бы начал с короткой тестовой сцены, а не с целой серии. Персонаж входит, что-то замечает и реагирует. На таком эпизоде проще проверить, сохраняет ли модель внешний вид героя, не путает ли порядок действий и получается ли собрать клипы в монтаж.

Сначала выпишите действия сцены. Затем попросите агента разложить их на кадры с длительностью, ракурсом и эмоцией. Проверьте, помещается ли каждое действие в отведённое время. После этого превратите кадры в видеопромты и сгенерируйте клипы. Соберите их в Google Vids или Canva, проверьте переходы, звук и совпадение реплик с движением.

Для повторяющихся персонажей заведите короткое описание внешности и используйте его в каждом кадре. Без причины не меняйте цвет волос, одежду или возраст. Если сервис принимает изображение-референс, проверьте, как именно он его использует. Одного имени персонажа может не хватить.

Длинные английские промты здесь не главное. До них сценарий уже превращён в план съёмки. Промт не исправит перепутанный порядок действий, слишком плотный хронометраж или непонятную реакцию персонажа.

Так можно собирать короткие аниме-сцены, рекламные наброски или видео для соцсетей, не придумывая каждый запрос с нуля. Но режиссёрские решения всё равно остаются за вами: агент предлагает план, а вы выбираете действие и решаете, на что должен смотреть зритель.

Я бы начал с раскадровки: получится ли разделить сцену на кадры, которые можно сгенерировать и смонтировать. Потом уже выбирал бы модель.

Промты для фото и видео собраны в библиотеке

Источники

Make free HD videos with Gemini in Google Vids

Generate and edit videos with Gemini Omni Flash

Gemini Omni 1.1 Flash now in Vids with improved extension quality, 1080p, and duration control

Grok Models & Pricing

Источникnote.com