Как сделать озвучку для видео: свой голос
Как сделать озвучку для видео, если у вас нет ни диктора, ни студии, ни навыков монтажа? В Вайб-Маркетологе это делается прямо в форме создания ролика: пишете текст, выбираете голос — и видео приходит с готовой русской начиткой. А если нужен именно ваш голос, его можно записать в браузере за полминуты и потом озвучивать им любые ролики. В этом уроке разберём оба пути по шагам, покажем реальные экраны кабинета и посчитаем стоимость.

Как сделать озвучку для видео: что это и как устроено
Это слой поверх сгенерированного ролика. Видео-модель снимает картинку и звук сцены, а речь синтезирует отдельный контур: он читает ваш русский текст и подмешивает голос в готовый ролик. Разделение не случайное — сами видео-модели по-русски говорят с ошибками в словах, и для рекламы это брак.
Работает на всех видео-моделях кабинета: Seedance 2.5 и Mini, Gemini Omni, MiniMax H3, PixVerse V6, Veo 3.1, Kling 3, Grok Imagine. Выбираете модель под задачу — озвучка добавляется одинаково.
Два режима на выбор
- Закадровый голос. Диктор читает текст поверх сцены, в кадре при этом никто не говорит. Подходит большинству рекламы: товар, услуга, объявление.
- Герой говорит в кадре. Человек в ролике произносит ваш текст, его губы синхронизируются под озвучку. Это формат UGC-рекламы, где герой смотрит в камеру и рассказывает.
Два источника голоса
- Наши дикторы. Шесть голосов: Полина, Виктория, Ольга, Максим, Дмитрий, Артём. Ничего настраивать не нужно.
- Мой голос. Ваш собственный, записанный один раз. Дешевле дикторского и работает во всех роликах и в озвучке текстов.
Для кого этот инструмент
Владельцу небольшого бизнеса
Вы сами лицо компании: мастер, тренер, владелец студии. Ваш голос узнают клиенты — и ролик с ним работает иначе, чем с чужим диктором. Записали голос один раз, дальше вся реклама говорит вами.
Продавцу на маркетплейсе
Короткие ролики к карточкам товаров: голос называет главное преимущество, картинка показывает товар. Пятисекундный ролик с озвучкой обходится в десятки рублей, а серия из десяти собирается за вечер.
SMM-специалисту
Сторис и Reels требуют потока. Тексты меняются часто, и возможность переозвучить ролик за минуту важнее, чем идеальный тембр: диктор с биржи такой скорости не даст.
Тому, кто делает обучающие видео
Инструкции, обучение сотрудников, разбор продукта. Голос объясняет, картинка показывает — и всё это без записи собственного голоса каждый раз заново.
Как сделать озвучку для видео: пошагово
- Откройте раздел «Видео» в кабинете и выберите модель. Для рекламы обычно берут Seedance 2.5 — она умеет ролики до 30 секунд.
- Настройте сам ролик: длительность, формат кадра, разрешение. От длительности зависит, сколько текста поместится.
- Включите переключатель «Русская озвучка». Он находится ниже настроек звука сцены.
- Напишите текст. Под полем появится счётчик: «46 из 135 знаков · речь ≈ 3,4 с». Если текст длиннее лимита, счётчик станет красным — сократите или увеличьте длительность ролика.
- Или надиктуйте текст. Справа в поле есть кнопка микрофона: нажмите, скажите фразу вслух — она превратится в текст. Удобно с телефона.
- Выберите режим: «Закадровый голос» или «Герой говорит в кадре».
- Выберите голос: «Наши дикторы» и один из шести — или «Мой голос», если он уже записан.
- Опишите сцену в поле ниже и проверьте сумму на кнопке. Она уже включает озвучку: например, «10с видео × 45 ₽ + озвучка 13 ₽ = 463 ₽».
- Запускайте. Сначала снимается видео, потом записывается голос, потом они сводятся. Вкладку можно закрыть — работа продолжится, готовый ролик появится в галерее.
Как записать свой голос
Это отдельный короткий сценарий, который делается один раз. Дальше ваш голос доступен и в роликах, и в озвучке текстов.

- Нажмите «Мой голос» в блоке озвучки, затем «Записать свой голос». Откроется студия.
- Прочитайте текст с экрана вслух. Он подобран так, чтобы в записи были разные звуки — примерно на тридцать секунд спокойного чтения.
- Следите за подсказкой. Пока идёт запись, видно живую волну микрофона и таймер. После двенадцатой секунды появится «достаточно, можно останавливать» — но лучше дочитать до конца.
- Послушайте запись. Если получилось шумно или сбились — «Записать заново», это бесплатно.
- Назовите голос и сохраните. Создание стоит 249 ₽ разово. Через минуту голос готов и сразу выбран.
Как записать хорошо с первого раза
- Тихая комната без эха: кухня или комната с мягкой мебелью лучше, чем пустой коридор.
- Обычный разговорный тон. «Дикторский» пафос звучит в клоне неестественно.
- Микрофон в 15–20 сантиметрах: слишком близко — призвуки дыхания, далеко — гулко.
- Телефон подойдёт: запись идёт прямо в браузере, приложение не нужно.
- Не торопитесь. Ровный спокойный темп даёт клону больше материала, чем быстрая скороговорка.
Запишите голос один раз — и все ролики будут говорить им.
Создать ролик с озвучкойПополнить балансКак написать текст, который хорошо звучит
Написанный и произнесённый текст ведут себя по-разному. Четыре приёма, которые заметно поднимают качество без переделки ролика.
Начните с главного
В ленте у вас две секунды. «Мы работаем с две тысячи десятого года и предлагаем широкий ассортимент» — за это время зритель успеет пролистать. «Свежая обжарка каждое утро» — уже понятно, о чём речь. История компании, если она нужна, идёт после оффера, а не до.
Пишите как говорите
Прочитайте текст вслух до генерации. Споткнулись на середине фразы — споткнётся и диктор. Обороты вроде «в связи с чем» и «осуществляем деятельность» на слух звучат казённо; замените на «поэтому» и «делаем».
Одна мысль — одно предложение
Точка даёт диктору паузу, а слушателю — время понять. Три коротких предложения воспринимаются легче, чем одно сложное с запятыми и оборотами.
Заканчивайте действием
Реклама без призыва — просто красивый ролик. «Заходите на чашку», «Оставьте заявку сегодня», «Забронируйте место» — конкретный глагол в конце работает лучше, чем «мы вас ждём».
Как собрать серию роликов в одном голосе
Отдельный ролик — это просто ролик. Серия в едином голосе — уже узнаваемый бренд, и собирается она без лишней работы.
Запишите свой голос один раз и используйте его во всех генерациях: даже если модели будут разные, а сцены — непохожие, голос свяжет ролики в одно целое. Это тот же принцип, что и фирменные цвета: человек не анализирует, но узнаёт.
Если голос принадлежит не вам, а сотруднику, который ведёт направление, — запишите отдельный голос под него. Голосов можно создать сколько нужно, каждый живёт в вашем кабинете и доступен в любой момент.
Для длинной серии держите под рукой короткий шаблон текста: первая фраза — оффер, вторая — выгода, третья — призыв. Меняется только содержание, ритм остаётся, и ролики звучат как единая кампания.
Разбор настроек
Счётчик знаков — главный ориентир
Диктор читает примерно 13,5 знака в секунду. Это значит: 10 секунд — 135 знаков, 15 секунд — 202, 30 секунд — 405. Счётчик считает это за вас и показывает примерную длину речи. Сервер тоже проверяет: слишком длинный текст он не примет и объяснит, на сколько сократить — деньги при этом не списываются.
Закадровый голос против «герой говорит»
Закадровый дешевле и надёжнее: сцена снимается без говорящих людей, голос ложится поверх. «Герой говорит» стоит дороже на 10 ₽ за секунду ролика, зато даёт эффект живой рекламы: человек в кадре обращается к зрителю. Берите второй режим, когда в кадре есть человек крупным планом; для товарных роликов без людей он бессмыслен.
Наши дикторы против своего голоса
Дикторы стоят 13 ₽ за начатую тысячу знаков, свой голос — 10 ₽. Одной тысячи хватает примерно на 74 секунды речи, так что большинство роликов укладывается в один блок. Свой голос выигрывает там, где важна узнаваемость; дикторы — там, где нужен нейтральный профессиональный тон или голос другого пола.
Что происходит со звуком сцены
Он не выключается, а приглушается: шум кофейни, шаги, атмосфера остаются фоном, голос звучит поверх. Речь начинается с небольшой задержкой — иначе первое слово обрывается в самом начале ролика.
Что делать с готовым роликом
Когда генерация закончилась, ролик появляется в галерее кабинета — в разделе «Видео», блок «Мои видео». Оттуда его можно скачать в mp4, открыть по ссылке или отправить заказчику. Галерея хранит работы без срока давности, поэтому удачные ролики удобно использовать как референсы для следующих.
Дальше обычно идут два коротких шага. Первый — титры и логотип: нейросети плохо рисуют текст в кадре, поэтому слоган, цену и контакты добавляют поверх готового видео в любом монтажном редакторе. Так надписи получаются чёткими и редактируемыми. Второй — обрезка под площадку, если один и тот же ролик идёт и в сторис, и в ленту.
Если ролик почти хорош, но озвучка не понравилась по темпу или голосу — не переделывайте видео целиком. Сгенерируйте заново с тем же описанием сцены, поменяв только голос: сцена выйдет похожей, а стоимость озвучки составляет считанные рубли.
Как проверить озвучку перед публикацией
Три быстрые проверки, которые экономят репутацию.
Послушайте со звуком телефона
Ролики смотрят с телефона, а не в наушниках за монитором. То, что на хорошей акустике звучит разборчиво, на динамике смартфона может утонуть в фоне сцены. Если голос теряется — сократите текст и выберите сцену потише: шумная улица «съедает» речь.
Проверьте ударения и числа
Особенно в названиях брендов, именах и адресах. Если синтез поставил ударение не туда, помогает простая перестановка слов или замена на синоним — переписать фразу быстрее, чем бороться с произношением.
Сверьте текст с картинкой
Классическая ошибка: голос говорит про скидку, а в кадре её нет; или речь заканчивается за три секунды до конца ролика, и зритель смотрит на молчаливую картинку. Лучше, когда речь занимает почти всю длину, а последняя секунда остаётся на логотип.
Под какую площадку что подходит
- Сторис и Reels. Вертикаль 9:16, 6–15 секунд, короткая фраза на 80–200 знаков. Голос бодрый, темп быстрый.
- Карточка товара на маркетплейсе. 5–10 секунд, спокойный голос, одна выгода. Здесь важнее показать товар, чем рассказать историю.
- Реклама в Директе и ВКонтакте. 20–30 секунд, полноценный сюжет: проблема, решение, призыв. Текста до 400 знаков.
- Обучающее видео. Длина по содержанию, голос ровный и нейтральный. Здесь чаще выбирают дикторов, а не свой голос: важна не узнаваемость, а разборчивость.
- Ролик от лица владельца. Свой голос плюс режим «герой говорит»: максимально близко к живому обращению, только без съёмки.
Сколько стоит
| Что | Цена | Комментарий |
|---|---|---|
| Голос диктора | 13 ₽ за 1000 знаков | начатая тысяча, хватает на 74 секунды речи |
| Свой голос | 10 ₽ за 1000 знаков | дешевле дикторского |
| Запись своего голоса | 249 ₽ разово | один раз, работает всегда |
| Герой говорит в кадре | 10 ₽ за секунду | 10 секунд — плюс 100 ₽ |
Примеры готовых роликов: 10 секунд в 720p на Seedance 2.5 с закадровым голосом — 463 ₽, с говорящим героем — 563 ₽. Пять секунд на PixVerse V6 с озвучкой — 53 ₽.
Сколько времени это занимает на практике
Полезно понимать реальные сроки, чтобы планировать работу, а не сидеть у экрана.
Запись голоса — один раз, около двух минут. Полминуты чтения, полминуты прослушать, минута на создание клона. Дальше этот шаг не повторяется никогда.
Ролик с закадровым голосом — от трёх до пятнадцати минут. Основное время уходит на само видео; озвучка добавляется за минуту после него. Вкладку можно закрыть: работа идёт на сервере, готовый ролик ждёт в галерее.
Режим «герой говорит» — плюс несколько минут. После озвучки ролик уходит на синхронизацию губ. Если провайдер занят, система повторит попытку сама, а при неудаче отдаст ролик с закадровым голосом и вернёт разницу.
Практический вывод: серию из пяти роликов удобно запускать подряд, а не ждать каждый. Пока считается первый, вы описываете второй.
Частые ошибки и как их избежать
- Текст длиннее ролика. Самая частая. Смотрите на счётчик: он краснеет заранее. Либо сокращайте, либо увеличивайте длительность.
- Цифры цифрами. «5 минут» синтез может прочитать не так, как вы ждёте. Пишите «пять минут». Телефоны и адреса лучше показывать титрами.
- Длинные предложения с оборотами. Вслух они рассыпаются. Три коротких фразы читаются лучше одной длинной.
- Режим «герой говорит» без человека в кадре. Синхронизировать губы не у кого — деньги за слой уйдут впустую. Проверьте, что в описании сцены есть человек крупным планом.
- Запись голоса в шумном месте. Клон повторяет и шум тоже. Тридцать секунд в тишине дают результат заметно лучше, чем минута на улице.
- Ожидание эмоций по команде. «Прошепчи с придыханием» в тексте не сработает: характер задаётся выбором голоса, а не ремарками.
- Попытка озвучить чужой ролик. Озвучка накладывается только на видео, созданное здесь же.
Частые вопросы
Как сделать озвучку для видео бесплатно?
Полностью бесплатно не получится: синтез речи стоит денег на стороне провайдера. Но новым пользователям начисляется приветственный бонус, которого хватает на первые ролики, а сама озвучка — самая дешёвая часть: 13 ₽ за тысячу знаков против сотен рублей за само видео.
Можно ли озвучить своим голосом?
Да. Запишите голос в студии (249 ₽ разово), дальше выбирайте «Мой голос» в любом ролике. Стоимость озвучки им — 10 ₽ за тысячу знаков.
Нужен ли профессиональный микрофон?
Нет. Подойдёт микрофон ноутбука или телефона. Важнее тишина в комнате, чем цена микрофона.
Сколько ждать готовый ролик?
Видео готовится от двух до тридцати минут в зависимости от модели и длины, озвучка добавляется за минуту после него. Режим «герой говорит» добавляет ещё несколько минут на синхронизацию губ.
Что будет, если озвучка не получится?
Стоимость озвучки вернётся на баланс, а ролик придёт без голоса. Если не удастся синхронизация губ — вернётся её стоимость, а ролик придёт с закадровым голосом. За само видео деньги не теряются.
Можно ли записать несколько голосов?
Да, сколько нужно: свой, коллеги, разные тона для разных линеек. Каждый голос создаётся отдельно и стоит 249 ₽.
Голос будет действительно похож на мой?
Система запоминает тембр и манеру из вашей записи. Чем ровнее и естественнее образец, тем ближе результат. Если первый клон не понравился — запишите ещё один в более тихом месте.
А озвучить просто текст, без видео?
Для этого есть вкладка «Аудио»: тот же голос, на выходе аудиофайл. Свой голос там тоже доступен, и студия записи открывается той же кнопкой.
Советы
- Начинайте с черновика: сделайте ролик в 480p с озвучкой, послушайте — и только потом повторяйте в 1080p.
- Держите библиотеку удачных текстов: то, что хорошо прозвучало один раз, сработает и на похожем товаре.
- Записывайте голос сразу с запасом: тридцать секунд ровного чтения дают клону больше, чем пятнадцать.
- Читайте текст вслух перед генерацией — так вы сразу услышите, влезает ли он в хронометраж.
- Разбор самой модели и её цен — в новости «Нейросеть для озвучки: русский голос в роликах».
- Если ещё не пробовали генерацию видео — начните с урока «Нейросеть для создания видео: гайд Seedance 2.5».