Разделы
6. Оживление
и анимация
Сценарий есть!
Персонажи есть!
Локации есть!
Теперь нам надо создавать живые сцены!
Есть простой тест, который отличает дешёвый AI-ролик от дорогого на первый же взгляд, ещё до оценки сюжета: движется ли в кадре что-то, кроме главного объекта действия. Реальный мир никогда не статичен - даже в полностью неподвижной сцене есть ветер в траве, лёгкое дыхание, пылинки в луче света, микродвижения ткани.

Отсутствие этих деталей - главный визуальный маркер того, что кадр сгенерирован и не доработан, поэтому будь внимателен к мелочам.

Вот тебе несколько ключевых моментов к этой теме:
Ветер самый универсальный и самый недооценённый инструмент оживления кадра, потому что он одновременно двигает несколько слоёв: волосы, ткань одежды, траву, пыль. Указание ветра в промпте почти всегда даёт немедленный прирост реалистичности.
«лёгкий ветер колышет края плаща и пряди волос» / «порывистый ветер пригибает высокую траву волнами»
Пыль и частицы поднятые шагами, или частицы, взвешенные в луче света, добавляют кадру ощущение объёма и физического присутствия воздуха как среды
«пыль поднимается лёгким облаком от каждого шага» / «в луче света видны медленно плывущие пылинки»
Одежда и ткань. Ткань должна реагировать на движение и ветер, а не оставаться жёсткой геометрической формой. Это особенно важно для плаща богатыря — статичный, «приклеенный» плащ мгновенно выдаёт генерацию.
«плащ развевается и слегка запаздывает за движением тела» / «край одежды слегка колышется от ветра»
Волосы. Так же, как ткань, волосы и борода должны иметь собственную, независимую от жёсткого тела персонажа динамику
«пряди волос слегка шевелятся от ветра, борода естественно двигается при повороте головы»
Дыхание. Важнейшая и часто игнорируемая деталь для статичных или медленных сцен. Едва заметное движение груди и плеч превращает «застывшую куклу» в живого персонажа.
«грудь медленно поднимается и опускается в такт спокойному дыханию» / «тяжелое прерывистое дыхание»
Живность. Присутствие животного в кадре (котёнок, лошадь, птицы на фоне) требует отдельного описания его собственного, независимого поведения - животное не должно выглядеть декорацией.
«котёнок настороженно принюхивается, слегка подрагивают усы» / «лошадь переступает с ноги на ногу, встряхивает гривой»
Ветер — самый универсальный и самый недооценённый инструмент оживления кадра, потому что он одновременно двигает несколько слоёв: волосы, ткань одежды, траву, пыль. Указание ветра в промпте почти всегда даёт немедленный прирост реалистичности.
«лёгкий ветер колышет края плаща и пряди волос» / «порывистый ветер пригибает высокую траву волнами»
Дым от костра и огонь. Эффектный, но физически сложный для модели элемент; работает лучше при описании конкретного источника и направления движения
«тонкая струйка дыма от углей костра поднимается и рассеивается, слегка отклоняясь от ветра»
или простое «на заднем фоне активно горит огонь»
Это все можно назвать “фоновыми движениями” И! тут важно, не перегрузить. А то нейронка с ума сойдет. Добавляйте несколько деталей или описывайте все простыми словами, обобщайте движения. (мастер промт для анимации тоже предоставлю)

Сейчас модели (но не все) хорошо понимают, что если идет ветер и колышется трава, то должны колыхаться и листочки на деревьях. Поэтому каааждую мелочь не описывайте. Но ключевые моменты, формирующие атмосферу, пишите обязательно
Как работают модели видеогенераций.
*мастер-промт для видео
И какие они бывают?
Мы то хотим качество. А нейронки эти нас не понимают.

Поэтому - правила:

1) Камера - описывается сразу. Вы, скорее всего, понятия не имеете какая линза за что отвечает. Это не критично. Просто следите за тем, чтобы все генерации как фото, так и видео были с какой-то одной камерой, которую предложит вам чатгпт. Иначе у вас будет каждый раз разное фокусное расстояние итд итп.

2) Движения камеры - их много. Опишите словами в чатгпт как хотите чтобы она двигалась и в мастерпромте все будет указано. Проверяйте этот момент тоже. (в последней главе будут все ракурсы камеры, берите оттуда

3) Конкретное описание движений и всех действий четкими глаголами с указанием скорости, направления, а не абстрактными прилагательными
“Богатырь движется уверенно - плохо
“Богатырь делает медленный, тяжелый шаг вперед, плащ слегка колышется от движения - хорошо

4) Одно действие на клип. Лучше генерировать много контролируемых кусков по 3-5 секунд, чем один непонятный длинный.
Очень большая часть генерации зависит от сгенерированной вамим картинки и выбранной модели. Чаще всего я использую Kling 3.0, потому что она бюджетная и закрывает все мои задачи. Сцены с сильным ветром и живой природой я делал в более дорогостоящей Veo 3.1 (все внутри хигсфилда)
Kling 3.0 - сильная
Лучший баланс цена/качество; сильнейшая физика движения человека.
Multi-Shot - возможность собрать до 6 монтажных склеек внутри одной генерации с сохранением персонажа
Veo 3.1 - редко, но можно
Хороший выбор для природных и атмосферных планов, хорошая звукогенерация, физика одежды, волос, фоновых элементов на высоте.
Самая дорогая из этих трех. Причем, существенно
Seedance 2.5 - топ
Мультикадровые сцены, где критична консистентность персонажа между несколькими сгенерированными клипами подряд. Не дешевая, но очень сильная модель
Моделей много, некоторые могут высадить все токены за пару видео. Будьте аккуратны, прежде чем нажимать кнопку генерации на видео. Проверяйте цену. (нет смысла генерировать в 4к, кстати, ты же не фильм для кино делаешь. нейронки часто 4к сразу ставят в настройках и по ошибке можешь слить деньги очень быстро. ставь 1080р каждый раз при смене модели)

Картинка решает 70% результата, промпт для видео - это только движение, камера и мелкие детали жизни. Разбивай сцену на простые, физически однозначные действия, и не пытайся впихнуть невпихиваемое в один клип - на монтаже это всё равно склеится лучше, чем если нейронка попробует сама разрулить сложную последовательность

Для KLING / VEO / FLUX итп. (или для seedance в случае генераций кусочков)
Master Prompt (video):
From this point on, you act as a technical prompt writer for AI video generation. Turn any input I give you into a ready-to-use video prompt, following these rules:
Structure — always in this order:
  1. Camera — always first. Shot type and movement (static, slow pan, dolly-in, tracking shot, handheld).
  2. Subject + one action — exactly one physical action, described with a concrete verb, not an abstract state.
  3. Environment — visible physical elements only (wind, dust, grass, fabric), matched to one consistent direction/source.
  4. Light — source, direction, quality (hard/soft). No mood words on their own — mood must come from light + pace + color, not a label.
  5. Style — lens/texture keywords only if I haven't already fixed them for the project.
Hard rules:
  • One clip = one continuous shot = one action. If my input implies two actions or two camera angles, split it into separate prompts and tell me how many clips you created.
  • Never use words that imply a cut or a time skip ("then," "after that," "meanwhile").
  • No evaluative words ("epic," "amazing," "beautiful," "dramatic"). Convert any such intent into concrete visual/technical language.
  • If I've already provided a character reference image, don't re-describe appearance — only describe what's new: motion, camera, light.
  • If my input is missing information needed for camera, action, or light, ask me a short clarifying question before producing the final prompt — don't guess.
  • Always output the final prompt in English.
Confirm you understand, then wait for my input.
Сохрани и применяй
Для Seedance 2.5 в случае генерации одного длинного сложного видео
Master Prompt (video — single continuous long take):

From this point on, you act as a technical prompt writer for AI video generation on Seedance 2.5. Turn any input I give you into a ready-to-use video prompt for ONE continuous long-take shot, following these rules:

Structure — always in this order:

1. Camera — always first. Shot type and movement for the entire duration (static, slow pan, dolly-in, tracking shot, handheld, POV). If the movement changes over time, describe it as one continuous trajectory (e.g. "pans left to right, then tilts down without cutting"), never as separate shots.
2. Timeline of actions — break the shot into a simple time-stamped sequence (e.g. "0-3s: ... / 3-6s: ... / 6-10s: ..."). Each stage gets exactly one concrete physical action per subject, described with a concrete verb, not an abstract state. Environment or lighting shifts (including full location transformations) are allowed mid-shot, but must be written as continuous, physical transitions happening in front of the camera — never as a cut or edit.
3. Subjects — list every subject and what they physically do at their point in the timeline. Reference any character/image I've given by tag (see image rule below) instead of re-describing their appearance.
4. Environment — visible physical elements only (wind, dust, grass, fabric, walls, objects), matched to one consistent direction/source at each stage of the timeline.
5. Light — source, direction, quality (hard/soft) at each stage. If light changes across the timeline, describe it as a physical shift (e.g. "light source shifts from hard overhead to soft warm ambient as the room resolves"). No mood words on their own — mood must come from light + pace + color, not a label.
6. Style — lens/texture keywords only if I haven't already fixed them for the project.

Image reference rule:
Any image I've given you must be referenced in the prompt using tags in the order I gave them: @image1, @image2, @image3, etc. Never re-describe the appearance of a subject or object that already has an image tag — only describe what's new: motion, camera, light, environment.

Hard rules:

* One clip = one continuous shot = the entire timeline, with no cuts, no camera-angle jumps, and no "meanwhile"/"then"/"after that" implying an edit. Time only moves forward within the same take.
* Multiple actions and even full environment transformations ARE allowed, as long as they're described as physically continuous events happening within the one moving/static camera shot, sequenced by timestamp.
* No evaluative words ("epic," "amazing," "beautiful," "dramatic"). Convert any such intent into concrete visual/technical language.
* If I've already provided a character reference image, don't re-describe appearance — only describe what's new: motion, camera, light.
* If my input is missing information needed for camera, action, timeline pacing, or light, ask me a short clarifying question before producing the final prompt — don't guess.
* Always output the final prompt in English.
Сохрани и применяй
Закинь в чат этот мастер-промт. Вспомни свой шот-лист. Опиши словами действие и скинь картинку с референсом (опционально). Спустя пару секунд ты получишь промт для анимации. Проверь его. Переходи в Хигсфилд, выбирай модель во вкладке "Видео", вставляй кадр, промт и жди результат

Осталось повторить действие для каждого кадра и вот у тебя готовы куски для монтажа.

И помни - ни у кого не получается все куски делать с первого раза. Я смотрю за топами, они, бывает, делают по 2-3-5-10 генераций на один кусочек.
Главное, не в тупую кнопку жми. А пересмотри промт. Постарайся выявить закономерность. Может модель поменять стоит. Результат требует усидчивости.
seedance 2.5
как работать
Эта модель является номер 1 на рынке по реализму. Она позволяет добавлять до 50 референсов (картинок, видео и аудио) и их обязательно! нужно тегать через @image1 @image2 @video1 @audio1 итп. по порядку. Чтобы было проще, загружайте в чатгпт/клод/гемини фото в такой же последовательности как и в сам seedance и указывайте этой текстовой нейронке все добавленные фото либо сразу через эти теги, либо добавляете следующий текст
"все указанные мной изображения пиши в промт через теги @image1 / @image2 и.т.д"

и тогда вам нужно будет просто вставить промт и нужные картинки сразу отметятся соответствующими тегами/ условно, как на этом изображении ниже.
Так же совет: прописывайте четкие тайминги. Так вы лучше будете контролировать сцены в длительных генерациях
Made on
Tilda