Как сделать рекламный ролик с ИИ: гайд без диктора
Пошаговый гайд: как сделать рекламный ролик с помощью ИИ без диктора, студии и больших бюджетов. Сценарий, голос, монтаж — всё онлайн за 1 день. Разбор от Спикми.
Что нужно для рекламного ролика: минимальный набор инструментов
Для короткого ролика (15–60 секунд) нужно закрыть четыре задачи. ИИ берёт на себя три из них — человек отвечает только за цель и оффер.
Сценарий — ChatGPT, Claude или любой LLM. Пишет текст по структуре: крючок → оффер → призыв к действию. Задача человека: сформулировать, что продаём и кому.
Голос — нейросеть для генерации речи. Берёт готовый текст и отдаёт MP3. Speakmi (Спикми) — с оплатой картой РФ, токены не сгорают, первые 30 секунд бесплатно. ElevenLabs — качественные голоса, но бесплатный лимит кончается быстро, TTS Maker — два русских голоса без эмоций, совсем бесплатно.
Видеоряд — Kling или Veo 3.1 генерируют сцены по текстовому описанию; Canva или CapCut собирают ролик из фото товара. Если нет бюджета на видеогенерацию — слайды с текстом и фотографиями тоже работают.
Монтаж — CapCut, Canva, Clideo. Всё онлайн, без установки.
Что ИИ не сделает за тебя: не придумает цель ролика, не сформулирует уникальное предложение, не проверит, соответствует ли текст правилам площадки.
Сколько стоит сделать рекламный ролик: диктор vs ИИ-генерация
Живой диктор — это не просто цена за минуту. Это ещё ожидание, правки через переписку и новый заказ при любом изменении текста. ИИ-озвучка меняет всю механику.
| Параметр | Живой диктор | ИИ-озвучка (Speakmi) |
|---|---|---|
| Стоимость минуты | 500–3000 ₽ | ~10–13 ₽ |
| Срок готовности | 1–2 дня | 30 секунд |
| Правка одной фразы | Новый заказ, новое ожидание | Исправил текст → переозвучил сразу |
| Оплата картой РФ | Да | Да |
| Бесплатный тест | Нет | Первые 30 секунд бесплатно |
| Лимит на длину | Договорной | Токены не сгорают, озвучивай частями |
Стоимость минуты у Speakmi — примерно 10–13 ₽ против 500–3000 ₽ у диктора, и цена видна ещё до нажатия кнопки «Озвучить».
Данные по ценам на дикторские услуги: vc.ru, 18.02.2026.

Как написать сценарий для рекламного ролика с помощью ИИ
Сценарий для ролика на 30 секунд — это примерно 70–80 слов. Структура: крючок (проблема или неожиданный факт) → оффер (что именно и для кого) → CTA (одно конкретное действие).
Шаг 1. Сформулируй задачу сам. До промта ответь на три вопроса: что продаём, кому, какое действие должен совершить зритель. Нейросеть не придумает оффер за тебя — она только упакует то, что ты дашь.
Шаг 2. Напиши промт. Пример для ChatGPT или Claude:
Напиши сценарий рекламного ролика на 30 секунд. Продукт: [название]. Аудитория: [кто]. Проблема, которую решаем: [что]. Целевое действие: [перейти на сайт / написать в директ / позвонить]. Структура: крючок → оффер → CTA. Тон: [дружелюбный / деловой / энергичный]. Без клише вроде «лучший на рынке».
Шаг 3. Проверь хронометраж. Среднее чтение вслух — 130–150 слов в минуту. 30 секунд = 65–75 слов, 60 секунд = 130–150 слов. Попроси ИИ сократить или расширить до нужного объёма.
Шаг 4. Добавь паузы. Перед финальным CTA поставь многоточие или пустую строку — дикция нейросети обработает это как паузу. Это работает в Speakmi и большинстве других TTS-сервисов.
Пример готового текста на 30 секунд:
Каждый раз, когда нужен новый голос — ждёшь два дня и платишь снова? Speakmi генерирует голос за 30 секунд. Вставляешь текст, выбираешь голос, скачиваешь MP3. Первые 30 секунд бесплатно — попробуй прямо сейчас на speakmi.ru.

Как озвучить рекламный ролик голосом ИИ без микрофона
Голос — то место в пайплайне, где конкуренты оставляют пустое место. Все гайды называют ElevenLabs, но не объясняют, что у него ограниченный бесплатный лимит, нет оплаты картой РФ и качество русского голоса нестабильно. Speakmi работает на движке Fish Audio — с русской локализацией, оплатой в рублях и постоянными голосами для повторного использования.
Fish Audio — товарный знак его правообладателя. Мы не являемся его представителем или партнёром; используем API Fish Audio как поставщика технологии генерации речи.
Шаг 1. Открой speakmi.ru или Telegram-бот t.me/speakmibot.
Шаг 2. Вставь текст сценария в поле ввода.
Шаг 3. Выбери голос из библиотеки. Если хочешь свой голос — запись-образец от 10 до 30 секунд, раздел «Мои голоса» в веб-студии или голосовое сообщение в Telegram-боте. Клонирование мгновенное.
Шаг 4. Нажми «Озвучить» — через несколько секунд скачай MP3.
Шаг 5. Не устраивает интонация в одной фразе? Исправь текст, переозвучь только этот кусок. Токены списываются только за то, что реально озвучил.
Первые 30 секунд бесплатно — хватит на большинство роликов для Reels и Shorts.
Как собрать рекламный ролик из голоса и видеоряда онлайн
Есть MP3 из Speakmi — дальше монтаж занимает 15–20 минут без установки программ.
Шаг 1. Открой CapCut в браузере (capcut.com) или Canva (canva.com). Оба работают онлайн, бесплатный уровень покрывает базовый монтаж.
Шаг 2. Создай новый проект. Для Reels и Stories — формат 9
, 1080×1920. Для YouTube — 16.Шаг 3. Загрузи видеоряд. Варианты по возрастанию стоимости:
-
фото товара или услуги (бесплатно)
-
стоковые клипы из библиотеки CapCut/Canva (бесплатно)
-
сгенерированные сцены в Kling или Veo 3.1 (платно, от нескольких долларов)
Шаг 4. Загрузи MP3. Расставь аудиодорожку по таймлайну, подгони нарезку видео под длительность голоса.
Шаг 5. Добавь субтитры. В CapCut — автогенерация по аудио за одну кнопку. В Canva — вручную. Субтитры критичны: большинство пользователей смотрят Reels без звука.
Шаг 6. Добавь фоновую музыку. Уровень громкости музыки — 15–20% от уровня голоса, иначе голос теряется.
Шаг 7. Экспортируй и загрузи на площадку. Для Яндекс Директа — MP4, не менее 720p. Для Reels/Shorts/VK Клипов — то же самое.

Какой голос выбрать для рекламного ролика: мужской, женский, нейтральный
Выбор голоса зависит от продукта и аудитории, а не от личных предпочтений.
Товары FMCG и массового спроса — женский голос с тёплой интонацией. Работает на широкую аудиторию, воспринимается как рекомендация, а не реклама.
B2B-услуги, финансы, юридические сервисы — мужской голос среднего темпа. Ассоциируется с надёжностью. Избегай излишне «продающего» темпа — он раздражает в профессиональном контексте.
Молодёжная аудитория, lifestyle, приложения — нейтральный или молодой голос с энергичной интонацией. Темп выше среднего, короткие фразы.
Темп речи. Для роликов до 30 секунд — чуть выше среднего (160–170 слов в минуту). Для объяснительных роликов и инструкций — спокойный темп (130–140 слов в минуту).
Если не уверен — сгенерируй два варианта голоса и покажи нескольким людям из целевой аудитории. В Speakmi библиотека голосов позволяет переключаться без дополнительных расходов — токены списываются только за финальную генерацию.
Как быстро внести правки в рекламный ролик без пересъёмки
Главная боль при работе с живым диктором — правка после сдачи равна новому заказу. Изменил одно слово в оффере, добавил акцию, поправил цену — снова бриф, снова ожидание, снова оплата.
С ИИ-озвучкой механика другая. Опечатка или неудачная фраза правится прямо в тексте и переозвучивается заново — без нового брифа и без ожидания следующего дня.
Конкретно это выглядит так:
-
Открываешь проект в Speakmi.
-
Меняешь нужную фразу в тексте.
-
Нажимаешь «Озвучить» — через 30 секунд новый MP3.
-
Заменяешь аудиодорожку в CapCut или Canva.
-
Экспортируешь обновлённый ролик.
Весь цикл — 5–10 минут. Токены не сгорают: купил пакет — списывается только то, что реально озвучил, хоть за день, хоть за полгода.
Это особенно важно при запуске акций с конкретными датами или ценами: когда акция заканчивается, ролик переозвучивается под следующую без пересъёмки видеоряда.

Частые вопросы
- Можно ли сделать рекламный ролик самому без опыта и студии?
- Да. Пайплайн «сценарий в LLM → озвучка в TTS-сервисе → монтаж в CapCut/Canva» не требует навыков видеопроизводства. Автор кейса на sostav.ru описывает себя как «пиарщик, не моушн-дизайнер» — и собрал полноценный ролик за вечер. Минимальный набор: текст продукта, аккаунт в нейросети для сценария, Speakmi для голоса, CapCut для монтажа.
- Сколько стоит генерация голоса для рекламного ролика через ИИ?
- В Speakmi — около 10–13 ₽ за минуту готовой озвучки (данные на сентябрь 2026). Первые 30 секунд бесплатно — хватает на большинство роликов для Reels и Shorts. Токены не сгорают: остаток пакета переходит на следующий месяц. Для сравнения: живой диктор — 500–3000 ₽ за минуту, плюс 1–2 дня ожидания (vc.ru, 18.02.2026).
- Какой длины должен быть рекламный ролик для соцсетей?
- Для Reels, TikTok и YouTube Shorts — 15–30 секунд, это 40–75 слов текста озвучки. Для VK Клипов и объяснительных роликов — до 60 секунд (130–150 слов). Для Яндекс Директа — от 6 до 60 секунд в зависимости от формата размещения. Чем короче — тем выше досматриваемость: ролики до 30 секунд удерживают аудиторию заметно лучше более длинных форматов.
- Как выбрать голос для рекламы: мужской или женский?
- Зависит от продукта и аудитории. Товары массового спроса — женский тёплый голос. B2B и финансы — мужской спокойный. Молодёжная аудитория и приложения — нейтральный энергичный. Универсальный способ: сгенерируй два варианта в Speakmi и покажи 3–5 людям из целевой аудитории — их реакция точнее любого правила. Переключение голосов не тратит токены.
- Можно ли использовать ИИ-голос в коммерческой рекламе?
- Да, если сервис явно разрешает коммерческое использование в условиях. Speakmi разрешает коммерческое использование сгенерированных аудиодорожек. Важный нюанс: если используешь клонирование голоса — только свой голос или голос человека, который дал письменное согласие. Голоса знаменитостей и публичных людей без их согласия — нарушение авторского права вне зависимости от инструмента.
- Как сделать рекламный ролик для Telegram-канала или Reels?
- Для Telegram — голосовое сообщение или короткое видео до 60 секунд. Озвучку MP3 из Speakmi загружаешь как голосовое сообщение или накладываешь на видео в CapCut. Для Reels — формат 9:16, 1080×1920, длина 15–30 секунд, обязательно субтитры (большинство смотрит без звука). Весь процесс: сценарий в ChatGPT → Speakmi → CapCut → экспорт MP4.
- Что делать, если нужно срочно переозвучить уже готовый ролик?
- Открываешь проект в Speakmi, меняешь нужный текст, нажимаешь «Озвучить» — новый MP3 готов за 30 секунд. Потом заменяешь аудиодорожку в CapCut или Canva и экспортируешь обновлённый файл. Весь цикл — 5–10 минут. Видеоряд пересъёмки не требует, если менялся только текст озвучки.
- Большие тексты можно озвучивать через ИИ?
- Да, но лучше делить на части. Speakmi озвучивает длинные тексты, но для рекламного ролика это не нужно — рабочая длина 40–150 слов. Если делаешь объяснительное видео на 5–10 минут, дели сценарий на смысловые блоки и озвучивай каждый отдельно: проще редактировать конкретный кусок, не переозвучивая всё целиком.

