Resemble еще одна нейросеть для создания AI-голоса. Сервис работает по принципу speech-to-speech, text-to-speech.
В этом материале разбираемся, что можно бесплатно делать в нейросети, чем она отличается от аналогов и в целом для каких задач подходит.
Что умеет Resemble AI
Нейросеть в основном используют для создания голоса. Для Ресембл АИ можно добавить текст, выбрать тон, и сервис сделает озвучку.
Что конкретно умеет Resemble AI:
- клонировать голос;
- менять озвучку в загруженном аудио;
- определять фейковые записи.
В Ресембл можно загружать файлы, либо записать аудио для обработки прямо в нейросети.
Как сгенерировать речь в нейросети
Сначала зайдите на официальный сайт Resemble AI, нажмите Get Started.

После авторизации откроется окно нейросети с рабочей панелью. Слева в Resemble выберите нужную вкладку с опцией, нажмите на нее.

Над областью ввода текста можно выбрать тип голоса, а на панели Ресембл АИ внизу, для чего именно нужна озвучка.

Если нужна озвучка на русском, то справа внизу выберите язык, а слева нажмите на кнопку, чтобы прослушать произношение выбранного образца.

Для изменения голоса на панели Resemble AI слева выберите Voice Changer, запишите или добавьте аудио в поле посередине.

После загрузки нейросеть обработает запись и поменяет озвучку. Чтобы создать собственный голос в Resemble, кликните на кнопку вверху над загруженным файлом.

Чтобы создать свой голос с нуля, напишите промпт в поле посередине, либо выберите рандомный запрос. Внизу в выделенной области можно прослушать другие готовые варианты озвучки.

Как и аналогичные нейросети Resemble делает довольно естественную речь для текста на английском. На русском получается более механический звук, который вряд ли подойдет для подкастов, аудиокниг.
Можно ли улучшить результат в Resemble AI
Качество озвучки можно улучшить в Ресембл, если следовать некоторым правилам при генерации речи в нейросети. Как повысить естественность произношения:
- использовать качественную запись, в которой темп речи не меняется (либо меняется не сильно) для клонирования;
- обрабатывать запись прямо в сервисе: убирать шумы, повышать качество звука в целом;
- тестировать образец сначала на коротком тексте.
В целом как и в любом подобном сервисе в Resemble нужно экспериментировать с настройками, чтобы достичь нужного качества обработки записи.
Сравнение нейросети с аналогами
Ресембл выбирают, потому что у нейросети удобный и простой интерфейс, есть возможность обработки аудио. Плюс к этому ИИ-сервис может определять фейковые голоса в записи, что делает программу ценной для восстановления репутации компаний.
Но при этом функции Resemble не уникальны, подобные опции есть и у других сервисов. Какие отличия есть у аналогов:
| Нейросеть | Главная фича |
| Resemble AI | Полный цикл обработки записи: создание и изменение голосов, повышение качества записи, определение фейков, выбор языка речи |
| ElevenLabs | Генерация реалистичной речи с эмоциями, акцентами по 30-минутному сэмплу; функция клонирования; набор аудиоинструментов (звуки, музыка, API для ботов) |
| Murf AI | Настройка тонов и скорости речи; редактирование текста прямо в нейросети; синхронизация аудио под видео и слайды |
| Speechify | Преобразование текста в речь с экспортом MP3 и WAV, выбор 30+ языков; высококачественные естественные голоса |
| Descript | Клонирование голоса для редактирования аудио как текста (удаление и замена слов с сохранением интонации) |
Resemble выбирают для создания реалистичной речи на английском и определения фейковых аудио. ElevenLabs чаще выбирают для генерации треков, озвучки. Murf AI выбирают для рекламы, обучающих роликов.
Speechify используют для озвучивания книг, подкастов. Descript выбирают для быстрой корректировки текста в ролике без перезаписывания голоса.
Для каких задач в итоге подходит Resemble AI
Ресембл АИ выбирают, когда нужно быстро создать реалистичный голос. С чем конкретно справится нейросеть:
- озвучкой NPC в геймдеве;
- обработкой аудио для клипов;
- создания уникального голоса бренда.
Resemble также выбирают для озвучки чат-ботов и виртуальных ассистентов.
FAQ
Об официальном приложении для телефонов ничего неизвестно. У сервиса есть только версия для запуска на ПК для корпоративных клиентов.
В бесплатном плане Resemble можно сгенерировать до 150 секунд или 5 минут речи, тестировать клонирование и изменение голосов.
Сервис использует новейшие AI-модели преобразования речи, глубокое обучение для сохранения естественного тона, четкости и эмоциональности речи. Качество звука 48 кГц.
Да, если установить приложение нейросети на ПК, то его можно использовать без интернета. Но эта функция доступна только корпоративным клиентам Resemble.
Помимо перечисленных аналогов есть Play.ht с обширной библиотекой образцов, HeyGen, в котором тоже можно клонировать голос. В качестве бесплатных вариантов с открытым кодом популярны Coqui TTS и Tortoise-TTS.
