Как сделать рекламный ролик с ИИ: гайд без диктора — Спикми

Как сделать рекламный ролик с ИИ: гайд без диктора

Пошаговый гайд: как сделать рекламный ролик с помощью ИИ без диктора, студии и больших бюджетов. Сценарий, голос, монтаж — всё онлайн за 1 день. Разбор от Спикми.

Что нужно для рекламного ролика: минимальный набор инструментов

Для короткого ролика (15–60 секунд) нужно закрыть четыре задачи. ИИ берёт на себя три из них — человек отвечает только за цель и оффер.

Сценарий — ChatGPT, Claude или любой LLM. Пишет текст по структуре: крючок → оффер → призыв к действию. Задача человека: сформулировать, что продаём и кому.

Голос — нейросеть для генерации речи. Берёт готовый текст и отдаёт MP3. Speakmi (Спикми) — с оплатой картой РФ, токены не сгорают, первые 30 секунд бесплатно. ElevenLabs — качественные голоса, но бесплатный лимит кончается быстро, TTS Maker — два русских голоса без эмоций, совсем бесплатно.

Видеоряд — Kling или Veo 3.1 генерируют сцены по текстовому описанию; Canva или CapCut собирают ролик из фото товара. Если нет бюджета на видеогенерацию — слайды с текстом и фотографиями тоже работают.

Монтаж — CapCut, Canva, Clideo. Всё онлайн, без установки.

Что ИИ не сделает за тебя: не придумает цель ролика, не сформулирует уникальное предложение, не проверит, соответствует ли текст правилам площадки.

Сколько стоит сделать рекламный ролик: диктор vs ИИ-генерация

Что на самом деле стоит диктор — Деловой мужской

Живой диктор — это не просто цена за минуту. Это ещё ожидание, правки через переписку и новый заказ при любом изменении текста. ИИ-озвучка меняет всю механику.

ПараметрЖивой дикторИИ-озвучка (Speakmi)
Стоимость минуты500–3000 ₽~10–13 ₽
Срок готовности1–2 дня30 секунд
Правка одной фразыНовый заказ, новое ожиданиеИсправил текст → переозвучил сразу
Оплата картой РФДаДа
Бесплатный тестНетПервые 30 секунд бесплатно
Лимит на длинуДоговорнойТокены не сгорают, озвучивай частями

Стоимость минуты у Speakmi — примерно 10–13 ₽ против 500–3000 ₽ у диктора, и цена видна ещё до нажатия кнопки «Озвучить».

Данные по ценам на дикторские услуги: vc.ru, 18.02.2026.

Сколько стоит сделать рекламный ролик: диктор vs ИИ-генерация — инфографика Speakmi

Попробовать Speakmi

Как написать сценарий для рекламного ролика с помощью ИИ

Сценарий на 30 секунд — Дикторский женский

Сценарий для ролика на 30 секунд — это примерно 70–80 слов. Структура: крючок (проблема или неожиданный факт) → оффер (что именно и для кого) → CTA (одно конкретное действие).

Шаг 1. Сформулируй задачу сам. До промта ответь на три вопроса: что продаём, кому, какое действие должен совершить зритель. Нейросеть не придумает оффер за тебя — она только упакует то, что ты дашь.

Шаг 2. Напиши промт. Пример для ChatGPT или Claude:

Напиши сценарий рекламного ролика на 30 секунд. Продукт: [название]. Аудитория: [кто]. Проблема, которую решаем: [что]. Целевое действие: [перейти на сайт / написать в директ / позвонить]. Структура: крючок → оффер → CTA. Тон: [дружелюбный / деловой / энергичный]. Без клише вроде «лучший на рынке».

Шаг 3. Проверь хронометраж. Среднее чтение вслух — 130–150 слов в минуту. 30 секунд = 65–75 слов, 60 секунд = 130–150 слов. Попроси ИИ сократить или расширить до нужного объёма.

Шаг 4. Добавь паузы. Перед финальным CTA поставь многоточие или пустую строку — дикция нейросети обработает это как паузу. Это работает в Speakmi и большинстве других TTS-сервисов.

Пример готового текста на 30 секунд:

Каждый раз, когда нужен новый голос — ждёшь два дня и платишь снова? Speakmi генерирует голос за 30 секунд. Вставляешь текст, выбираешь голос, скачиваешь MP3. Первые 30 секунд бесплатно — попробуй прямо сейчас на speakmi.ru.

Как написать сценарий для рекламного ролика с помощью ИИ — инфографика Speakmi

Как озвучить рекламный ролик голосом ИИ без микрофона

Голос — то место в пайплайне, где конкуренты оставляют пустое место. Все гайды называют ElevenLabs, но не объясняют, что у него ограниченный бесплатный лимит, нет оплаты картой РФ и качество русского голоса нестабильно. Speakmi работает на движке Fish Audio — с русской локализацией, оплатой в рублях и постоянными голосами для повторного использования.

Fish Audio — товарный знак его правообладателя. Мы не являемся его представителем или партнёром; используем API Fish Audio как поставщика технологии генерации речи.

Шаг 1. Открой speakmi.ru или Telegram-бот t.me/speakmibot.

Шаг 2. Вставь текст сценария в поле ввода.

Шаг 3. Выбери голос из библиотеки. Если хочешь свой голос — запись-образец от 10 до 30 секунд, раздел «Мои голоса» в веб-студии или голосовое сообщение в Telegram-боте. Клонирование мгновенное.

Шаг 4. Нажми «Озвучить» — через несколько секунд скачай MP3.

Шаг 5. Не устраивает интонация в одной фразе? Исправь текст, переозвучь только этот кусок. Токены списываются только за то, что реально озвучил.

Первые 30 секунд бесплатно — хватит на большинство роликов для Reels и Shorts.

Как собрать рекламный ролик из голоса и видеоряда онлайн

Есть MP3 из Speakmi — дальше монтаж занимает 15–20 минут без установки программ.

Шаг 1. Открой CapCut в браузере (capcut.com) или Canva (canva.com). Оба работают онлайн, бесплатный уровень покрывает базовый монтаж.

Шаг 2. Создай новый проект. Для Reels и Stories — формат 9

, 1080×1920. Для YouTube — 16
.

Шаг 3. Загрузи видеоряд. Варианты по возрастанию стоимости:

  • фото товара или услуги (бесплатно)

  • стоковые клипы из библиотеки CapCut/Canva (бесплатно)

  • сгенерированные сцены в Kling или Veo 3.1 (платно, от нескольких долларов)

Шаг 4. Загрузи MP3. Расставь аудиодорожку по таймлайну, подгони нарезку видео под длительность голоса.

Шаг 5. Добавь субтитры. В CapCut — автогенерация по аудио за одну кнопку. В Canva — вручную. Субтитры критичны: большинство пользователей смотрят Reels без звука.

Шаг 6. Добавь фоновую музыку. Уровень громкости музыки — 15–20% от уровня голоса, иначе голос теряется.

Шаг 7. Экспортируй и загрузи на площадку. Для Яндекс Директа — MP4, не менее 720p. Для Reels/Shorts/VK Клипов — то же самое.

Как собрать рекламный ролик из голоса и видеоряда онлайн — инфографика Speakmi

Какой голос выбрать для рекламного ролика: мужской, женский, нейтральный

Выбор голоса зависит от продукта и аудитории, а не от личных предпочтений.

Товары FMCG и массового спроса — женский голос с тёплой интонацией. Работает на широкую аудиторию, воспринимается как рекомендация, а не реклама.

B2B-услуги, финансы, юридические сервисы — мужской голос среднего темпа. Ассоциируется с надёжностью. Избегай излишне «продающего» темпа — он раздражает в профессиональном контексте.

Молодёжная аудитория, lifestyle, приложения — нейтральный или молодой голос с энергичной интонацией. Темп выше среднего, короткие фразы.

Темп речи. Для роликов до 30 секунд — чуть выше среднего (160–170 слов в минуту). Для объяснительных роликов и инструкций — спокойный темп (130–140 слов в минуту).

Если не уверен — сгенерируй два варианта голоса и покажи нескольким людям из целевой аудитории. В Speakmi библиотека голосов позволяет переключаться без дополнительных расходов — токены списываются только за финальную генерацию.

Попробовать Speakmi

Как быстро внести правки в рекламный ролик без пересъёмки

Главная боль при работе с живым диктором — правка после сдачи равна новому заказу. Изменил одно слово в оффере, добавил акцию, поправил цену — снова бриф, снова ожидание, снова оплата.

С ИИ-озвучкой механика другая. Опечатка или неудачная фраза правится прямо в тексте и переозвучивается заново — без нового брифа и без ожидания следующего дня.

Конкретно это выглядит так:

  1. Открываешь проект в Speakmi.

  2. Меняешь нужную фразу в тексте.

  3. Нажимаешь «Озвучить» — через 30 секунд новый MP3.

  4. Заменяешь аудиодорожку в CapCut или Canva.

  5. Экспортируешь обновлённый ролик.

Весь цикл — 5–10 минут. Токены не сгорают: купил пакет — списывается только то, что реально озвучил, хоть за день, хоть за полгода.

Это особенно важно при запуске акций с конкретными датами или ценами: когда акция заканчивается, ролик переозвучивается под следующую без пересъёмки видеоряда.


Как быстро внести правки в рекламный ролик без пересъёмки — инфографика Speakmi

Частые вопросы

Можно ли сделать рекламный ролик самому без опыта и студии?
Да. Пайплайн «сценарий в LLM → озвучка в TTS-сервисе → монтаж в CapCut/Canva» не требует навыков видеопроизводства. Автор кейса на sostav.ru описывает себя как «пиарщик, не моушн-дизайнер» — и собрал полноценный ролик за вечер. Минимальный набор: текст продукта, аккаунт в нейросети для сценария, Speakmi для голоса, CapCut для монтажа.
Сколько стоит генерация голоса для рекламного ролика через ИИ?
В Speakmi — около 10–13 ₽ за минуту готовой озвучки (данные на сентябрь 2026). Первые 30 секунд бесплатно — хватает на большинство роликов для Reels и Shorts. Токены не сгорают: остаток пакета переходит на следующий месяц. Для сравнения: живой диктор — 500–3000 ₽ за минуту, плюс 1–2 дня ожидания (vc.ru, 18.02.2026).
Какой длины должен быть рекламный ролик для соцсетей?
Для Reels, TikTok и YouTube Shorts — 15–30 секунд, это 40–75 слов текста озвучки. Для VK Клипов и объяснительных роликов — до 60 секунд (130–150 слов). Для Яндекс Директа — от 6 до 60 секунд в зависимости от формата размещения. Чем короче — тем выше досматриваемость: ролики до 30 секунд удерживают аудиторию заметно лучше более длинных форматов.
Как выбрать голос для рекламы: мужской или женский?
Зависит от продукта и аудитории. Товары массового спроса — женский тёплый голос. B2B и финансы — мужской спокойный. Молодёжная аудитория и приложения — нейтральный энергичный. Универсальный способ: сгенерируй два варианта в Speakmi и покажи 3–5 людям из целевой аудитории — их реакция точнее любого правила. Переключение голосов не тратит токены.
Можно ли использовать ИИ-голос в коммерческой рекламе?
Да, если сервис явно разрешает коммерческое использование в условиях. Speakmi разрешает коммерческое использование сгенерированных аудиодорожек. Важный нюанс: если используешь клонирование голоса — только свой голос или голос человека, который дал письменное согласие. Голоса знаменитостей и публичных людей без их согласия — нарушение авторского права вне зависимости от инструмента.
Как сделать рекламный ролик для Telegram-канала или Reels?
Для Telegram — голосовое сообщение или короткое видео до 60 секунд. Озвучку MP3 из Speakmi загружаешь как голосовое сообщение или накладываешь на видео в CapCut. Для Reels — формат 9:16, 1080×1920, длина 15–30 секунд, обязательно субтитры (большинство смотрит без звука). Весь процесс: сценарий в ChatGPT → Speakmi → CapCut → экспорт MP4.
Что делать, если нужно срочно переозвучить уже готовый ролик?
Открываешь проект в Speakmi, меняешь нужный текст, нажимаешь «Озвучить» — новый MP3 готов за 30 секунд. Потом заменяешь аудиодорожку в CapCut или Canva и экспортируешь обновлённый файл. Весь цикл — 5–10 минут. Видеоряд пересъёмки не требует, если менялся только текст озвучки.
Большие тексты можно озвучивать через ИИ?
Да, но лучше делить на части. Speakmi озвучивает длинные тексты, но для рекламного ролика это не нужно — рабочая длина 40–150 слов. Если делаешь объяснительное видео на 5–10 минут, дели сценарий на смысловые блоки и озвучивай каждый отдельно: проще редактировать конкретный кусок, не переозвучивая всё целиком.