Тот же движок синтеза речи, но доступ устроен под Россию.
Fish Audio — сильный движок: его модель S2-Pro занимает первое место на TTS-Arena и в слепых сравнениях выигрывает у ElevenLabs со счётом 60 на 40 (71 тысяча сравнений). Проблема не в качестве, а в доступе: интерфейс английский, подписка в долларах, российская карта не проходит, а до самого сайта из России дозвониться удаётся не всегда. Speakmi берёт синтез у Fish Audio по API и закрывает ровно этот разрыв.
Голоса звучат так жеСинтез делает тот же движок — мы не переобучали и не ухудшали его
Русский интерфейс и поддержкаНе нужно разбираться в английских настройках и писать в зарубежный саппорт
Оплата картой РФ и через СБПБез зарубежной карты, криптовалюты и посредников
Работает без VPNИ сайт, и Telegram-бот открываются напрямую
Подписка в долларах или разовый пакет в рублях
У Fish Audio — ежемесячные планы Plus, Pro и Max. У нас — пакеты, которые не сгорают.
Тарифы Fish Audio устроены как подписка: около 11 $ в месяц за план Plus (примерно 200 минут), 75 $ за Pro и 749 $ за Max, плюс бесплатный тариф примерно на 7 минут. Это удобно тем, кто озвучивает каждый день, и невыгодно тем, у кого нагрузка неровная: месяц пропустил — деньги списались всё равно. Мы сделали наоборот: платёж разовый, купленные токены остаются на балансе без срока годности, автосписаний нет.
Пакеты от 149 ₽ разовоПлатите, когда нужно, а не двенадцать раз в год
Токены не сгораютНеиспользованный остаток не аннулируется через месяц
Цена видна до списания«18 секунд озвучки — 12 токенов» показывается до нажатия кнопки
Чек и документыЧек по 54-ФЗ на email, юрлицам — счёт и закрывающие
Клонирование голоса — из голосового в Telegram
Fish Audio клонирует голос по записи 10–15 секунд. Мы — тоже, но без файлов и компьютера.
Механика та же: движку хватает короткого образца, чтобы дальше говорить вашим голосом. Разница в том, как этот образец до него доезжает. В Fish Audio нужно записать файл и загрузить его через веб-интерфейс. У нас достаточно отправить боту обычное голосовое сообщение на 10–30 секунд — через пару минут этот голос читает любой текст, и он же доступен в браузере под тем же аккаунтом.
Голосовое вместо загрузки файлаЗаписал как обычно — не нужен микрофон, тишина и десять дублей
Голос приватный по умолчаниюМодель не попадает в общий каталог и недоступна другим
Только свой голос, с подтверждениемЧужой голос склонировать нельзя — это условие сервиса
Общий аккаунт с браузеромСделал в боте — сразу видно на сайте, баланс и история одни
Подсказки эмоций работают так же
Шёпот на интриге, пауза перед фактом, смех в конце — прямо в тексте.
Движок понимает подсказки подачи, написанные внутри текста, и в этом одно из его главных отличий от обычных синтезаторов: эмоция задаётся не ползунком на весь ролик, а точечно, в нужной фразе. Мы этот механизм не урезали — подсказки пишутся в квадратных скобках там, где нужны, и вслух не читаются.
Я знаю, кто это сделал. [шёпотом] Только не говори никому.
[пауза] Это был... сосед. [смеётся]
Сама подсказка вслух не читается — она только меняет подачу.
Послушать, как это звучит
Подсказка в нужном месте фразыНе «весь ролик радостно», а точная подача по предложениям
Паузы и дыханиеРечь не звучит как непрерывный поток
Кнопки эмоций в ботеС телефона — без ручного набора подсказок
Голоса — те же, что слышно в демо
Спокойный женский, дикторский, бархатный мужской и ещё десятки типажей.
Fish Audio (в русском написании — «фиш аудио») — это сервис синтеза речи и клонирования голоса. Его модель S2-Pro занимает первое место на TTS-Arena, а в слепых сравнениях с ElevenLabs выигрывает со счётом 60 на 40 при 71 тысяче сравнений. Русский язык движок поддерживает, и звучит на нём хорошо.
Проблема у российского пользователя не в качестве, а в доступе.
Почему Fish Audio неудобен из России
Интерфейс на английском. Настройки, тарифы и поддержка — без русского языка.
Оплата в долларах. Подписки Plus, Pro и Max оплачиваются зарубежной картой; карта российского банка не проходит.
Доступ нестабилен. До сайта из России дозвониться удаётся не всегда, и нужен VPN.
Подписка вместо разового платежа. Пропустили месяц — деньги списались всё равно.
Что такое Speakmi и при чём тут Fish Audio
Speakmi (Спикми) — российский сервис озвучки, который использует API Fish Audio как поставщика технологии синтеза речи. Синтез делает тот же движок, поэтому голоса звучат так же — мы их не переобучали и не ухудшали.
Всё остальное сделано под Россию: русский интерфейс, оплата картой РФ и через СБП, чек по 54-ФЗ, Telegram-бот с клонированием голоса из голосового сообщения, разовые пакеты вместо валютной подписки и хранение данных на российской инфраструктуре.
Мы не являемся представителем Fish Audio, его партнёром или официальной русской версией сервиса.
Чем отличается доступ
Fish Audio
Speakmi
Интерфейс
Английский
Русский
Оплата
Зарубежная карта, доллары
Карта РФ и СБП, рубли
Модель оплаты
Подписка Plus / Pro / Max
Разовые пакеты, не сгорают
VPN
Часто нужен
Не нужен
Клонирование голоса
Загрузка файла в веб-интерфейсе
Голосовое сообщение в Telegram
Чек и документы
—
Чек 54-ФЗ, счёт для юрлиц
Движок синтеза
Свой
Тот же, по API
Сколько стоит
У Fish Audio: бесплатный тариф примерно на 7 минут, дальше Plus около 11 $ в месяц (примерно 200 минут), Pro 75 $, Max 749 $.
У нас: первые 30 секунд бесплатно без карты, дальше разовые пакеты от 149 ₽. В пересчёте — примерно 14–19 ₽ за минуту готовой озвучки в зависимости от пакета. Подписки нет, купленные токены не сгорают.
Частые заблуждения
«Есть официальный Fish Audio на русском». Официальной русской версии сервиса не существует. Есть сервисы вроде нашего, которые работают на его движке и делают доступ удобным — это разные вещи, и мы это различие проговариваем прямо.
«Можно скачать Fish Audio». Скачивать нечего: синтез идёт на серверах, работа — в браузере. Сборки «Fish Audio со взломом» — обычный способ раздать вредоносный файл.
«Без регистрации можно озвучить любой текст». Демо на этой странице слушается без регистрации, но для своего текста нужен email — и у нас, и у Fish Audio. Иначе сервис нечем защищать от злоупотреблений.
Сколько это стоит в рублях
Без подписки и без пересчёта долларов по курсу.
Стоимость считается по объёму текста, а не по длине готового аудио: за паузы и тишину платить не нужно. В пересчёте на минуту готовой озвучки выходит примерно 14–19 ₽ в зависимости от пакета. Цена видна в редакторе до нажатия кнопки, списание происходит после того, как файл готов.
Разовый платёж — подписки и автосписаний нет
Токены не сгорают — срока жизни у баланса нет
Оплата картой РФ и через СБП, без зарубежной карты
Перегенерация бесплатна — правка не стоит нового заказа
Первые 30 секунд — бесплатно, без карты. Оплата картой РФ и через СБП. Для юрлиц — счёт и закрывающие документы.
Не хватило — докупаете, остаток суммируется. Ничего не теряется.
Кто мы такие и кем не являемся
Speakmi — российский сервис. Fish Audio — товарный знак его правообладателя.
Мы не представитель Fish Audio, не его партнёр и не официальная русская версия сервиса. Мы используем API Fish Audio как поставщика технологии синтеза речи — так же, как сайт может использовать чужую платёжную или картографическую систему. Всё остальное — интерфейс, оплата, поддержка, Telegram-бот, хранение данных — наше и находится в России.
Мы не аффилированы с Fish AudioНи представительства, ни партнёрства, ни официального статуса
Движок раскрываем открытоЧтобы вы понимали, чей синтез слышите, и не покупали кота в мешке
Договор и чек — с российским ИПОплата проходит в рублях, чек по 54-ФЗ приходит на email
Данные хранятся в РоссииЗаписи голоса и файлы — на российской инфраструктуре, по 152-ФЗ
Ваш голос — только ваш
Клонировать можно свой голос и только с подтверждением прав.
Голос — биометрия, и мы относимся к нему соответственно. Модель создаётся приватной, в публичный каталог не попадает и другим пользователям недоступна. Удаление означает, что мы снимаем модель у поставщика технологии и стираем исходные записи, а не просто убираем голос из интерфейса.
Только свой голосС подтверждением прав, образцы проходят модерацию
Приватно по умолчаниюМодель не попадает в публичный каталог
Удаление — полноеСнимаем модель у провайдера и стираем файлы
Тексты генераций не логируемВ журналах нет того, что вы озвучивали
Нет. Speakmi — самостоятельный российский сервис, который использует API Fish Audio как поставщика технологии синтеза речи. Мы не представитель Fish Audio, не его партнёр и не официальная русская версия. Голоса звучат так же, потому что синтез делает тот же движок, а интерфейс, оплата, поддержка и Telegram-бот — наши.
Fish Audio есть на русском языке?
Сам сервис Fish Audio работает на английском интерфейсе. Русский язык движок поддерживает — на нём говорят голоса, и качество на русском высокое. Если нужен русский интерфейс, оплата в рублях и поддержка по-русски, это как раз то, что даёт Speakmi на том же движке.
Можно ли пользоваться Fish Audio из России без VPN?
К самому fish.audio доступ из России нестабилен, и оплата их подписки российской картой не проходит. Speakmi работает напрямую, без VPN: и сайт, и Telegram-бот. Оплата идёт картой российского банка или через СБП, чек по 54-ФЗ приходит на почту.
Сколько стоит Fish Audio и сколько у вас?
У Fish Audio подписки в долларах: Plus 11 $ в месяц примерно за 200 минут, Pro 75 $, Max 749 $, плюс бесплатный тариф около 7 минут. У нас нет подписки: пакеты токенов от 149 ₽ разово, они не сгорают и автосписаний нет. Первые 30 секунд бесплатны и не требуют карты.
Можно попробовать бесплатно и без регистрации?
Демо на этой странице слушается без регистрации — это готовые записи, сделанные тем же движком. Чтобы озвучить собственный текст, нужен только email: первые 30 секунд бесплатны, карту привязывать не надо. Полностью анонимной озвучки нет ни у нас, ни у Fish Audio — иначе сервис нечем защищать от злоупотреблений.
Где скачать Fish Audio и есть ли приложение?
Скачивать нечего: и Fish Audio, и Speakmi работают в браузере, устанавливать программу не нужно. У нас вдобавок есть Telegram-бот — по сути приложение, которое уже стоит на телефоне: отправляете голосовое, получаете озвучку своим голосом прямо в чате.
Есть ли взломанная версия или бесплатный безлимит?
Нет, и искать не стоит: синтез идёт на серверах, взламывать в браузере нечего, а сборки «со взломом» — обычный способ раздать вредоносный файл. Бесплатный доступ у нас честный: 30 секунд озвучки без карты, дальше разовые пакеты от 149 ₽ без подписки.
Мой голос, склонированный здесь, попадёт в Fish Audio?
Модель голоса создаётся приватной и в общий каталог не попадает. Клонировать можно только свой голос и с подтверждением прав. При удалении мы снимаем модель у поставщика технологии и стираем исходные файлы, а не просто прячем голос из интерфейса.
Чем ваши голоса отличаются от голосов Fish Audio?
Это те же голоса того же движка — разницы в звучании нет, и мы не обещаем, что она есть. Отличие в доступе: русский интерфейс, оплата картой РФ и через СБП, работа без VPN, клонирование голоса прямо из голосового сообщения в Telegram и разовые пакеты вместо валютной подписки.
Есть ли у вас API, как у Fish Audio?
Публичного API у Speakmi пока нет — сейчас это веб-редактор и Telegram-бот. Если нужен именно программный доступ, у Fish Audio есть собственный API с тарификацией по объёму текста; мы про свой сообщим отдельно, когда он появится.
Послушайте движок на своём тексте
Первые 30 секунд бесплатно, без карты. Вход по email, VPN не нужен.