Z-Image — фотореалистичное фото за 1,2 ₽ Veo 3.1 и Seedance — видео со звуком, от 120 ₽ Gemini Omni — говорящий персонаж с русской озвучкой GPT-5 и Claude 4.8 Opus — ответы от 3 ₽ Suno 5.5 — песня целиком за 99 ₽ Sora 2 и Kling 3 — уже внутри, за рубли Grok Video — рекламный ролик за 36 ₽ +20% бонусами к первому пополнению — до 6000 ₽
Видео

Как сделать озвучку для видео: свой голос

Как сделать озвучку для видео: свой голос — иллюстрация урока Вайб-Маркетолога

Как сделать озвучку для видео, если у вас нет ни диктора, ни студии, ни навыков монтажа? В Вайб-Маркетологе это делается прямо в форме создания ролика: пишете текст, выбираете голос — и видео приходит с готовой русской начиткой. А если нужен именно ваш голос, его можно записать в браузере за полминуты и потом озвучивать им любые ролики. В этом уроке разберём оба пути по шагам, покажем реальные экраны кабинета и посчитаем стоимость.

lk.vibemarketolog.ru/video
Как сделать озвучку для видео: блок русской озвучки в кабинете
Блок «Русская озвучка» в настройках ролика: текст, счётчик знаков, режим и выбор голоса.

Как сделать озвучку для видео: что это и как устроено

Это слой поверх сгенерированного ролика. Видео-модель снимает картинку и звук сцены, а речь синтезирует отдельный контур: он читает ваш русский текст и подмешивает голос в готовый ролик. Разделение не случайное — сами видео-модели по-русски говорят с ошибками в словах, и для рекламы это брак.

Работает на всех видео-моделях кабинета: Seedance 2.5 и Mini, Gemini Omni, MiniMax H3, PixVerse V6, Veo 3.1, Kling 3, Grok Imagine. Выбираете модель под задачу — озвучка добавляется одинаково.

Два режима на выбор

  • Закадровый голос. Диктор читает текст поверх сцены, в кадре при этом никто не говорит. Подходит большинству рекламы: товар, услуга, объявление.
  • Герой говорит в кадре. Человек в ролике произносит ваш текст, его губы синхронизируются под озвучку. Это формат UGC-рекламы, где герой смотрит в камеру и рассказывает.

Два источника голоса

  • Наши дикторы. Шесть голосов: Полина, Виктория, Ольга, Максим, Дмитрий, Артём. Ничего настраивать не нужно.
  • Мой голос. Ваш собственный, записанный один раз. Дешевле дикторского и работает во всех роликах и в озвучке текстов.

Для кого этот инструмент

Владельцу небольшого бизнеса

Вы сами лицо компании: мастер, тренер, владелец студии. Ваш голос узнают клиенты — и ролик с ним работает иначе, чем с чужим диктором. Записали голос один раз, дальше вся реклама говорит вами.

Продавцу на маркетплейсе

Короткие ролики к карточкам товаров: голос называет главное преимущество, картинка показывает товар. Пятисекундный ролик с озвучкой обходится в десятки рублей, а серия из десяти собирается за вечер.

SMM-специалисту

Сторис и Reels требуют потока. Тексты меняются часто, и возможность переозвучить ролик за минуту важнее, чем идеальный тембр: диктор с биржи такой скорости не даст.

Тому, кто делает обучающие видео

Инструкции, обучение сотрудников, разбор продукта. Голос объясняет, картинка показывает — и всё это без записи собственного голоса каждый раз заново.

Как сделать озвучку для видео: пошагово

  1. Откройте раздел «Видео» в кабинете и выберите модель. Для рекламы обычно берут Seedance 2.5 — она умеет ролики до 30 секунд.
  2. Настройте сам ролик: длительность, формат кадра, разрешение. От длительности зависит, сколько текста поместится.
  3. Включите переключатель «Русская озвучка». Он находится ниже настроек звука сцены.
  4. Напишите текст. Под полем появится счётчик: «46 из 135 знаков · речь ≈ 3,4 с». Если текст длиннее лимита, счётчик станет красным — сократите или увеличьте длительность ролика.
  5. Или надиктуйте текст. Справа в поле есть кнопка микрофона: нажмите, скажите фразу вслух — она превратится в текст. Удобно с телефона.
  6. Выберите режим: «Закадровый голос» или «Герой говорит в кадре».
  7. Выберите голос: «Наши дикторы» и один из шести — или «Мой голос», если он уже записан.
  8. Опишите сцену в поле ниже и проверьте сумму на кнопке. Она уже включает озвучку: например, «10с видео × 45 ₽ + озвучка 13 ₽ = 463 ₽».
  9. Запускайте. Сначала снимается видео, потом записывается голос, потом они сводятся. Вкладку можно закрыть — работа продолжится, готовый ролик появится в галерее.

Как записать свой голос

Это отдельный короткий сценарий, который делается один раз. Дальше ваш голос доступен и в роликах, и в озвучке текстов.

lk.vibemarketolog.ru/video
Клонирование голоса: студия записи в браузере
Студия голоса: текст для чтения, кнопка записи и три понятных шага.
  1. Нажмите «Мой голос» в блоке озвучки, затем «Записать свой голос». Откроется студия.
  2. Прочитайте текст с экрана вслух. Он подобран так, чтобы в записи были разные звуки — примерно на тридцать секунд спокойного чтения.
  3. Следите за подсказкой. Пока идёт запись, видно живую волну микрофона и таймер. После двенадцатой секунды появится «достаточно, можно останавливать» — но лучше дочитать до конца.
  4. Послушайте запись. Если получилось шумно или сбились — «Записать заново», это бесплатно.
  5. Назовите голос и сохраните. Создание стоит 249 ₽ разово. Через минуту голос готов и сразу выбран.

Как записать хорошо с первого раза

  • Тихая комната без эха: кухня или комната с мягкой мебелью лучше, чем пустой коридор.
  • Обычный разговорный тон. «Дикторский» пафос звучит в клоне неестественно.
  • Микрофон в 15–20 сантиметрах: слишком близко — призвуки дыхания, далеко — гулко.
  • Телефон подойдёт: запись идёт прямо в браузере, приложение не нужно.
  • Не торопитесь. Ровный спокойный темп даёт клону больше материала, чем быстрая скороговорка.

Запишите голос один раз — и все ролики будут говорить им.

Создать ролик с озвучкойПополнить баланс

Как написать текст, который хорошо звучит

Написанный и произнесённый текст ведут себя по-разному. Четыре приёма, которые заметно поднимают качество без переделки ролика.

Начните с главного

В ленте у вас две секунды. «Мы работаем с две тысячи десятого года и предлагаем широкий ассортимент» — за это время зритель успеет пролистать. «Свежая обжарка каждое утро» — уже понятно, о чём речь. История компании, если она нужна, идёт после оффера, а не до.

Пишите как говорите

Прочитайте текст вслух до генерации. Споткнулись на середине фразы — споткнётся и диктор. Обороты вроде «в связи с чем» и «осуществляем деятельность» на слух звучат казённо; замените на «поэтому» и «делаем».

Одна мысль — одно предложение

Точка даёт диктору паузу, а слушателю — время понять. Три коротких предложения воспринимаются легче, чем одно сложное с запятыми и оборотами.

Заканчивайте действием

Реклама без призыва — просто красивый ролик. «Заходите на чашку», «Оставьте заявку сегодня», «Забронируйте место» — конкретный глагол в конце работает лучше, чем «мы вас ждём».

Как собрать серию роликов в одном голосе

Отдельный ролик — это просто ролик. Серия в едином голосе — уже узнаваемый бренд, и собирается она без лишней работы.

Запишите свой голос один раз и используйте его во всех генерациях: даже если модели будут разные, а сцены — непохожие, голос свяжет ролики в одно целое. Это тот же принцип, что и фирменные цвета: человек не анализирует, но узнаёт.

Если голос принадлежит не вам, а сотруднику, который ведёт направление, — запишите отдельный голос под него. Голосов можно создать сколько нужно, каждый живёт в вашем кабинете и доступен в любой момент.

Для длинной серии держите под рукой короткий шаблон текста: первая фраза — оффер, вторая — выгода, третья — призыв. Меняется только содержание, ритм остаётся, и ролики звучат как единая кампания.

Разбор настроек

Счётчик знаков — главный ориентир

Диктор читает примерно 13,5 знака в секунду. Это значит: 10 секунд — 135 знаков, 15 секунд — 202, 30 секунд — 405. Счётчик считает это за вас и показывает примерную длину речи. Сервер тоже проверяет: слишком длинный текст он не примет и объяснит, на сколько сократить — деньги при этом не списываются.

Закадровый голос против «герой говорит»

Закадровый дешевле и надёжнее: сцена снимается без говорящих людей, голос ложится поверх. «Герой говорит» стоит дороже на 10 ₽ за секунду ролика, зато даёт эффект живой рекламы: человек в кадре обращается к зрителю. Берите второй режим, когда в кадре есть человек крупным планом; для товарных роликов без людей он бессмыслен.

Наши дикторы против своего голоса

Дикторы стоят 13 ₽ за начатую тысячу знаков, свой голос — 10 ₽. Одной тысячи хватает примерно на 74 секунды речи, так что большинство роликов укладывается в один блок. Свой голос выигрывает там, где важна узнаваемость; дикторы — там, где нужен нейтральный профессиональный тон или голос другого пола.

Что происходит со звуком сцены

Он не выключается, а приглушается: шум кофейни, шаги, атмосфера остаются фоном, голос звучит поверх. Речь начинается с небольшой задержкой — иначе первое слово обрывается в самом начале ролика.

Что делать с готовым роликом

Когда генерация закончилась, ролик появляется в галерее кабинета — в разделе «Видео», блок «Мои видео». Оттуда его можно скачать в mp4, открыть по ссылке или отправить заказчику. Галерея хранит работы без срока давности, поэтому удачные ролики удобно использовать как референсы для следующих.

Дальше обычно идут два коротких шага. Первый — титры и логотип: нейросети плохо рисуют текст в кадре, поэтому слоган, цену и контакты добавляют поверх готового видео в любом монтажном редакторе. Так надписи получаются чёткими и редактируемыми. Второй — обрезка под площадку, если один и тот же ролик идёт и в сторис, и в ленту.

Если ролик почти хорош, но озвучка не понравилась по темпу или голосу — не переделывайте видео целиком. Сгенерируйте заново с тем же описанием сцены, поменяв только голос: сцена выйдет похожей, а стоимость озвучки составляет считанные рубли.

Как проверить озвучку перед публикацией

Три быстрые проверки, которые экономят репутацию.

Послушайте со звуком телефона

Ролики смотрят с телефона, а не в наушниках за монитором. То, что на хорошей акустике звучит разборчиво, на динамике смартфона может утонуть в фоне сцены. Если голос теряется — сократите текст и выберите сцену потише: шумная улица «съедает» речь.

Проверьте ударения и числа

Особенно в названиях брендов, именах и адресах. Если синтез поставил ударение не туда, помогает простая перестановка слов или замена на синоним — переписать фразу быстрее, чем бороться с произношением.

Сверьте текст с картинкой

Классическая ошибка: голос говорит про скидку, а в кадре её нет; или речь заканчивается за три секунды до конца ролика, и зритель смотрит на молчаливую картинку. Лучше, когда речь занимает почти всю длину, а последняя секунда остаётся на логотип.

Под какую площадку что подходит

  • Сторис и Reels. Вертикаль 9:16, 6–15 секунд, короткая фраза на 80–200 знаков. Голос бодрый, темп быстрый.
  • Карточка товара на маркетплейсе. 5–10 секунд, спокойный голос, одна выгода. Здесь важнее показать товар, чем рассказать историю.
  • Реклама в Директе и ВКонтакте. 20–30 секунд, полноценный сюжет: проблема, решение, призыв. Текста до 400 знаков.
  • Обучающее видео. Длина по содержанию, голос ровный и нейтральный. Здесь чаще выбирают дикторов, а не свой голос: важна не узнаваемость, а разборчивость.
  • Ролик от лица владельца. Свой голос плюс режим «герой говорит»: максимально близко к живому обращению, только без съёмки.

Сколько стоит

ЧтоЦенаКомментарий
Голос диктора13 ₽ за 1000 знаковначатая тысяча, хватает на 74 секунды речи
Свой голос10 ₽ за 1000 знаковдешевле дикторского
Запись своего голоса249 ₽ разовоодин раз, работает всегда
Герой говорит в кадре10 ₽ за секунду10 секунд — плюс 100 ₽

Примеры готовых роликов: 10 секунд в 720p на Seedance 2.5 с закадровым голосом — 463 ₽, с говорящим героем — 563 ₽. Пять секунд на PixVerse V6 с озвучкой — 53 ₽.

Сколько времени это занимает на практике

Полезно понимать реальные сроки, чтобы планировать работу, а не сидеть у экрана.

Запись голоса — один раз, около двух минут. Полминуты чтения, полминуты прослушать, минута на создание клона. Дальше этот шаг не повторяется никогда.

Ролик с закадровым голосом — от трёх до пятнадцати минут. Основное время уходит на само видео; озвучка добавляется за минуту после него. Вкладку можно закрыть: работа идёт на сервере, готовый ролик ждёт в галерее.

Режим «герой говорит» — плюс несколько минут. После озвучки ролик уходит на синхронизацию губ. Если провайдер занят, система повторит попытку сама, а при неудаче отдаст ролик с закадровым голосом и вернёт разницу.

Практический вывод: серию из пяти роликов удобно запускать подряд, а не ждать каждый. Пока считается первый, вы описываете второй.

Частые ошибки и как их избежать

  • Текст длиннее ролика. Самая частая. Смотрите на счётчик: он краснеет заранее. Либо сокращайте, либо увеличивайте длительность.
  • Цифры цифрами. «5 минут» синтез может прочитать не так, как вы ждёте. Пишите «пять минут». Телефоны и адреса лучше показывать титрами.
  • Длинные предложения с оборотами. Вслух они рассыпаются. Три коротких фразы читаются лучше одной длинной.
  • Режим «герой говорит» без человека в кадре. Синхронизировать губы не у кого — деньги за слой уйдут впустую. Проверьте, что в описании сцены есть человек крупным планом.
  • Запись голоса в шумном месте. Клон повторяет и шум тоже. Тридцать секунд в тишине дают результат заметно лучше, чем минута на улице.
  • Ожидание эмоций по команде. «Прошепчи с придыханием» в тексте не сработает: характер задаётся выбором голоса, а не ремарками.
  • Попытка озвучить чужой ролик. Озвучка накладывается только на видео, созданное здесь же.

Частые вопросы

Как сделать озвучку для видео бесплатно?

Полностью бесплатно не получится: синтез речи стоит денег на стороне провайдера. Но новым пользователям начисляется приветственный бонус, которого хватает на первые ролики, а сама озвучка — самая дешёвая часть: 13 ₽ за тысячу знаков против сотен рублей за само видео.

Можно ли озвучить своим голосом?

Да. Запишите голос в студии (249 ₽ разово), дальше выбирайте «Мой голос» в любом ролике. Стоимость озвучки им — 10 ₽ за тысячу знаков.

Нужен ли профессиональный микрофон?

Нет. Подойдёт микрофон ноутбука или телефона. Важнее тишина в комнате, чем цена микрофона.

Сколько ждать готовый ролик?

Видео готовится от двух до тридцати минут в зависимости от модели и длины, озвучка добавляется за минуту после него. Режим «герой говорит» добавляет ещё несколько минут на синхронизацию губ.

Что будет, если озвучка не получится?

Стоимость озвучки вернётся на баланс, а ролик придёт без голоса. Если не удастся синхронизация губ — вернётся её стоимость, а ролик придёт с закадровым голосом. За само видео деньги не теряются.

Можно ли записать несколько голосов?

Да, сколько нужно: свой, коллеги, разные тона для разных линеек. Каждый голос создаётся отдельно и стоит 249 ₽.

Голос будет действительно похож на мой?

Система запоминает тембр и манеру из вашей записи. Чем ровнее и естественнее образец, тем ближе результат. Если первый клон не понравился — запишите ещё один в более тихом месте.

А озвучить просто текст, без видео?

Для этого есть вкладка «Аудио»: тот же голос, на выходе аудиофайл. Свой голос там тоже доступен, и студия записи открывается той же кнопкой.

Советы

  • Начинайте с черновика: сделайте ролик в 480p с озвучкой, послушайте — и только потом повторяйте в 1080p.
  • Держите библиотеку удачных текстов: то, что хорошо прозвучало один раз, сработает и на похожем товаре.
  • Записывайте голос сразу с запасом: тридцать секунд ровного чтения дают клону больше, чем пятнадцать.
  • Читайте текст вслух перед генерацией — так вы сразу услышите, влезает ли он в хронометраж.
  • Разбор самой модели и её цен — в новости «Нейросеть для озвучки: русский голос в роликах».
  • Если ещё не пробовали генерацию видео — начните с урока «Нейросеть для создания видео: гайд Seedance 2.5».
Поделиться уроком
Telegram ВКонтакте
Обновление Что нового: Нейросеть для озвучки: русский голос в роликах
Попробовать +100 ₽ в подарок Пополнить баланс