Нейросеть видео по сценарию: рабочий промпт
Нейросеть видео по сценарию — это когда вы заранее знаете, что окажется в кадре: какой герой, в какой обстановке, что он сделает первым, что вторым и чем всё закончится. На практике у большинства получается иначе: человек пишет подробное описание на десять строк, нажимает «Создать», а модель выдаёт что-то своё. В этом уроке разберём, почему так выходит и как писать описание, чтобы результат совпадал с задумкой с первой-второй попытки, а не с десятой.
Материал построен на статистике реальных генераций в кабинете Вайб Маркетолога: мы посмотрели, чем отличаются описания, после которых ролик получается, от тех, после которых приходится переделывать. Выводы оказались неочевидными — и они сэкономят вам и время, и деньги.

Нейросеть видео по сценарию: что это и когда нужно
Все модели генерации видео работают по одному принципу: они читают текстовое описание и достраивают всё, чего вы не сказали. Не сказали про время суток — будет любое. Не сказали, что герой один и тот же — во втором действии он может измениться. Не сказали, где происходит дело — модель придумает обстановку сама.
Отсюда простое правило: предсказуемость результата — это не магия удачного промпта, а количество решений, которые вы приняли за модель. Чем меньше белых пятен вы оставили, тем ближе ролик к задумке.
Нейросеть видео по сценарию нужна не всегда. Если вам достаточно красивой абстрактной заставки или фоновой перебивки — пишите одно предложение и не усложняйте. Сценарий нужен там, где ролик должен что-то рассказать: реклама товара, короткая сценка для соцсетей, обучающий фрагмент, ролик с узнаваемым героем.
Чем сценарий отличается от простого описания
Простое описание отвечает на вопрос «что мы видим». Сценарий отвечает ещё на два: «в каком порядке» и «кто именно в кадре». Разница в подходе выглядит так:
- Описание: «Мужчина на кухне варит кофе, солнечное утро».
- Сценарий: «Сначала мужчина у кофемашины наливает кофе. Затем ставит две чашки на поднос. В конце выходит с подносом из кухни. Утро, солнце из окна, тёплый свет».
Второй вариант даёт модели последовательность, и она перестаёт выбирать её за вас. Это и есть основной инструмент управления результатом.
Для кого этот инструмент
Сценарный промпт особенно окупается в этих сценариях:
- Реклама товара для маркетплейса или соцсетей. Нужно показать товар в действии: взяли, открыли, применили, показали результат. Порядок кадров тут — половина смысла ролика.
- Короткие сценки с постоянным героем. Блогерский формат, серия роликов про одного персонажа, ведущий бренда. Герой должен выглядеть одинаково во всех роликах.
- Обучающие фрагменты и объяснялки. Действие должно идти по шагам, иначе зритель не поймёт логику.
- Заготовки для монтажа. Вы снимаете несколько коротких сцен, чтобы потом собрать из них полноценный ролик.
- Тесты гипотез для рекламы. Когда нужно быстро проверить пять вариантов одной сцены, важно, чтобы менялась ровно одна деталь, а не весь кадр целиком.
Как написать промпт для видео по сценарию: пошагово
Разберём весь путь от чистого поля до готового ролика. Открывайте раздел «Видео» в кабинете и идите по шагам вместе с нами.
- Определите длительность до того, как писать текст. Это самый недооценённый шаг. Длительность — это бюджет вашего сценария: в пять секунд помещается одно-два законченных действия, не больше. Три действия требуют восьми-десяти секунд, полноценная сценка с завязкой и развязкой — пятнадцати. Если сценарий не помещается, лишнее не «ускорится» — оно просто не попадёт в кадр.
- Выберите модель под задачу. В карточках моделей сразу видна цена и главные возможности. PixVerse V6 — самая доступная и самая гибкая по режимам, с неё удобно начинать. Seedance 2.5 берут, когда нужен ролик подлиннее и покачественнее. MiniMax H3 — когда важен звук в 2K. Открывать все модели подряд не нужно: сначала добейтесь предсказуемости на дешёвой, потом переносите готовый сценарий на дорогую.
- Опишите обстановку одним блоком. Место, время суток, свет, настроение — это фон, который не меняется весь ролик. Пишите его отдельно от действий: «Кухня в светлой квартире, утро, мягкий солнечный свет из окна, спокойная бытовая атмосфера».
- Перечислите действия по порядку. Каждое действие — отдельная короткая фраза. Порядок задают слова «сначала», «затем», «в конце» — или таймкоды вида «0–2с», «2–4с», модель понимает и то, и другое. Главное — последовательность, а не точный хронометраж.
- Зафиксируйте героя, если он важен. Если персонаж должен выглядеть определённым образом, недостаточно описать его словами: «девушка тридцати лет» модель поймёт по-своему в каждой генерации. Загрузите фото в режиме «Референсы» и ссылайтесь на него прямо в описании.
- Выберите формат кадра под площадку. Вертикальный 9:16 — для сторис и коротких видео, горизонтальный 16:9 — для сайта и презентаций. Формат влияет на композицию: в вертикальном кадре модель ставит героя крупнее.
- Решите, нужен ли звук. Звук генерируется вместе с картинкой и стоит дороже. Если ролик пойдёт под музыку или закадровый голос, отключите его и сэкономьте.
- Проверьте цену на кнопке и запускайте. Итоговая сумма всегда видна до списания — она пересчитывается при смене длительности, качества и звука.
- Оцените результат и меняйте по одной детали. Если ролик почти получился, не переписывайте описание целиком: зафиксируйте seed и поправьте одну фразу. Так вы увидите, что именно дала правка.

Разбор опций, которые управляют результатом
В панели видео нет случайных настроек: каждая забирает у модели часть свободы и отдаёт её вам. Разберём главные.
Длительность: главный ограничитель сценария
Длительность задаётся ползунком от трёх до пятнадцати секунд и напрямую влияет на цену — она считается за секунду. Но важнее денег другое: длительность определяет, сколько действий физически поместится.
Ориентир простой: одно законченное действие занимает три-четыре секунды экранного времени. Персонаж подошёл к столу — это три секунды. Взял чашку и поднёс к губам — ещё три. Обернулся и вышел — ещё четыре. Если вы описали три действия и поставили пять секунд, модель покажет первое и оборвёт остальное — не потому, что «не поняла», а потому, что времени нет.
Режим работы: пять разных инструментов в одной модели
У PixVerse V6 пять режимов, и они решают принципиально разные задачи:
- По описанию — ролик с нуля, только по тексту. Максимум свободы у модели, минимум предсказуемости. Подходит для абстрактных сцен и фонов.
- Оживить фото — вы даёте одну картинку, модель приводит её в движение. Композиция и герой уже заданы, остаётся управлять только движением.
- Переход между кадрами — вы задаёте первый и последний кадр, модель придумывает, как перейти от одного к другому. Самый предсказуемый режим: начало и конец под вашим контролем.
- Референсы — до семи фото, на которые вы ссылаетесь прямо в тексте. Главный режим для сценариев с конкретными героями и предметами.
- Продлить видео — продолжение вашего готового ролика. Так собираются длинные сцены: сняли пятнадцать секунд, продлили ещё на пятнадцать.
Референсы: как показать модели героя, а не описать словами
Это самый сильный инструмент предсказуемости и одновременно тот, где чаще всего спотыкаются. Механика такая: вы загружаете фото, система подписывает каждое из них — первое становится @Image1, второе @Image2 и так далее. Подписи видны прямо под миниатюрами. В описании вы ссылаетесь на эти имена: «@Image1 стоит у окна и держит @Image2».
Имена придумывать нельзя — модель знает только те, которые выданы системой. Написать «@герой» или «@кухня» не получится: ссылка окажется в пустоту. Если сомневаетесь — посмотрите на подпись под фотографией, там всегда написано правильное имя.
Референсы решают сразу три задачи: герой перестаёт меняться от генерации к генерации, товар выглядит как ваш товар, а не как похожий, и обстановка остаётся той же самой в серии роликов.

Мультисцена: когда действий больше, чем помещается в один план
В тонких настройках есть переключатель «Мультисцена». В положении «Один план» модель снимает всё одним непрерывным кадром — как будто камера не выключалась. В положении «Несколько сцен» она сама разбивает ролик на планы со сменой ракурса.
Для сценария из трёх действий «Несколько сцен» обычно даёт более понятный результат: каждое действие получает свой кадр. Переключатель доступен в режимах «По описанию» и «Оживить фото».
Seed: как повторить удачный результат
Seed — это число, которое фиксирует случайность. Оставьте «Авто» — каждая генерация будет новой. Впишите конкретное число — и с тем же описанием получите тот же ролик.
Это рабочий инструмент точечной доводки: получили почти то, что нужно, — запомните seed, поменяйте одну фразу в описании и запустите снова. Изменится ровно то, что вы правили, а не всё сразу.

Формат кадра и качество
Формат выбирается под площадку: 9:16 для сторис и коротких вертикальных видео, 16:9 для сайта, презентаций и YouTube, 1:1 для ленты. Качество влияет на цену: черновые прогоны имеет смысл делать в низком разрешении и поднимать его только для финального варианта — сценарий при этом остаётся тем же.
Русская озвучка
Отдельный переключатель под полем описания добавляет к ролику закадровый голос на русском: вы пишете текст, диктор его читает, звук подмешивается в готовое видео. Это не то же самое, что встроенный звук модели — там генерируются шумы и эмбиент сцены.
Проверьте сценарный подход на своём ролике — черновой прогон в низком разрешении стоит меньше чашки кофе.
Создать видеоПополнить балансЧто показывает статистика удачных описаний
Мы посмотрели на генерации видео в кабинете за последние три месяца и сравнили описания, после которых ролик получился, с теми, после которых пришлось переделывать. Результат ломает главный миф новичка — «чем короче, тем надёжнее».
| Длина описания | Доля удачных роликов |
|---|---|
| Меньше 100 символов | 68 процентов |
| От 100 до 300 символов | 87 процентов |
| От 300 до 700 символов | 77 процентов |
| От 700 до 1500 символов | 76 процентов |
| Больше 1500 символов | 88 процентов |
Читается это так. Самый плохой вариант — описание в одну строку: модель достраивает почти всё сама, и совпадение с задумкой становится делом случая. Уверенный минимум начинается со ста символов — это два-три предложения, где названы место, герой и действие.
Дальше кривая проседает: описания на триста-полторы тысячи символов часто представляют собой поток подробностей без структуры. А вот самые длинные снова дают высокий результат — но только потому, что до такого объёма доходят люди, которые уже пишут структурированно: обстановка отдельно, действия по порядку, герой на референсе.
Медиана удачного описания — около пятисот символов. Это примерно один абзац обстановки и три-четыре коротких предложения действий. Не роман и не одна строка.
Сколько стоит
Оплата за секунду готового ролика, без подписки и абонентской платы. Деньги списываются с баланса кабинета, сумма всегда видна на кнопке до запуска.
| Вариант | Цена | Ролик 10 секунд |
|---|---|---|
| PixVerse V6, 360p без звука | 4 рубля за секунду | 40 рублей |
| PixVerse V6, 720p со звуком | 10 рублей за секунду | 100 рублей |
| PixVerse V6, 1080p со звуком | 19 рублей за секунду | 190 рублей |
| Seedance 2.5 | от 80 рублей за ролик | зависит от длины |
| MiniMax H3 | от 148 рублей за ролик | зависит от длины |
Практический вывод: черновики сценария гоняйте в низком разрешении и без звука. Пока вы ищете формулировку, качество картинки не важно — важно, попадает ли модель в задуманную последовательность. Когда сценарий устоялся, поднимите разрешение и включите звук для финального прогона.
Частые ошибки и как их избежать
- Три действия в пятисекундном ролике. Самая частая причина «модель меня не поняла». Она поняла — ей не хватило времени. Либо увеличьте длительность, либо сократите сценарий.
- Придуманные имена референсов. Ссылаться можно только на те подписи, которые система поставила под фотографиями. Своё название работать не будет.
- Описание в одну строку. «Красивый ролик про кофе» отдаёт модели все решения. Добавьте место, время суток и хотя бы одно конкретное действие.
- Смена всего описания после неудачи. Так вы теряете информацию: непонятно, какая правка помогла. Меняйте по одной детали, зафиксировав seed.
- Внешность героя словами вместо фото. «Молодой мужчина в синей рубашке» — это тысяча разных мужчин. Референс решает вопрос за одну загрузку.
- Ожидание точного хронометража. Таймкоды в описании читаются как порядок действий, а не как монтажный лист с точностью до секунды. Если нужен именно точный тайминг — собирайте ролик из отдельных сцен в Монтажной студии.
- Финальное качество на этапе поиска. Десять черновиков в 1080p со звуком стоят как небольшой рекламный бюджет. Ищите формулировку дёшево.
Частые вопросы
Можно ли расписать видео по секундам?
Да, таймкоды вида «0–2с», «2–5с» модель понимает и выстраивает действия в указанном порядке. Но воспринимайте их как последовательность, а не как точный хронометраж: ровно две секунды на кадр никто не отмеряет. Формулировки «сначала — затем — в конце» работают так же хорошо.
Почему нейросеть генерирует не то, что я описал?
Три причины по частоте: действий больше, чем помещается в выбранную длительность; описание слишком короткое и модель достраивает недостающее сама; герой задан словами вместо фото-референса. Начните с длительности — она чаще всего и виновата.
Сколько стоит создать видео по сценарию?
Черновой ролик на пять секунд в низком разрешении обойдётся примерно в двадцать рублей, финальный десятисекундный в 720p со звуком — в сто рублей. Подписки нет, платите только за готовые ролики.
Как сделать, чтобы герой был одинаковым в разных роликах?
Загрузите одно и то же фото героя в режиме «Референсы» и ссылайтесь на него в описании. Дополнительно зафиксируйте seed — тогда совпадёт не только внешность, но и общий стиль кадра.
Нужна ли подписка или VPN?
Ни того, ни другого. Кабинет работает из России без VPN, оплата в рублях с баланса, деньги списываются за конкретный ролик.
Что делать, если сценарий не помещается в пятнадцать секунд?
Есть два пути. Первый — режим «Продлить видео»: снимаете первую часть, затем продолжаете её. Второй, более управляемый, — Монтажная студия: она режет сценарий на короткие сцены, снимает каждую отдельно и склеивает в единый ролик с музыкой и озвучкой.
Чем встроенный звук отличается от русской озвучки?
Встроенный звук — это шумы и атмосфера сцены, которые модель генерирует вместе с картинкой. Русская озвучка — отдельный слой: вы пишете текст, диктор читает его, и голос подмешивается в готовый ролик. Для рекламы обычно нужен второй вариант.
Можно ли повторить понравившийся ролик с одной правкой?
Да, для этого и нужен seed. Впишите то же число, оставьте описание почти прежним и поменяйте одну фразу — изменится только она.
Советы
- Пишите обстановку и действия разными блоками — модель лучше держит фон, когда он не перемешан с движением.
- Одно предложение — одно действие. Длинные составные фразы с деепричастными оборотами модель разбирает хуже.
- Заведите себе шаблон промпта для видео по сценарию: место и время суток, герой, три действия по порядку, стиль съёмки. По нему описание пишется за минуту.
- Начинайте с дешёвой модели и низкого разрешения. Сценарий, который работает на PixVerse V6, почти всегда переносится на Seedance 2.5 без переделки.
- Если нужен ролик из готового фото — посмотрите разбор как оживить фото в видео с озвучкой: там герой задан кадром изначально.
- Общий обзор всех видео-моделей кабинета с ценами есть в уроке как создавать рекламные видео нейросетями.
- Когда важна точная длина каждой сцены, используйте посекундную генерацию — там вы платите ровно за заказанные секунды.
Соберите свой первый сценарный ролик прямо сейчас: три действия, десять секунд, фото героя в референсах.
Открыть раздел «Видео»Пополнить баланс