Создание AI-модели певческого голоса (RVC / SVC)

Бюджет: 20 000 руб
234.94 $ – 202.95 €
Нужно создать и качественно настроить нейросетевую модель конкретного голоса для исполнения песен.

Задача: на вход подается готовая вокальная партия, исполненная другим голосом, а на выходе должно получаться максимально естественное исполнение заданным голосом и тембром, с сохранением мелодии, интонаций и особенностей вокальной подачи.

Речь идет не об обычном клонировании речи и не о создании голоса для озвучки текста. Нужна работа именно с певческим голосом — Singing Voice Conversion.

Можно использовать RVC, SVC, so-vits-svc, Diff-SVC, DDSP-SVC или другие технологии. Привязки к конкретному ПО нет: если для получения более естественного результата существует более подходящее решение, готовы его рассмотреть.

Есть большое количество исходных записей — песни, вокальные дорожки и другой аудиоматериал. При необходимости можно специально записать дополнительный материал по техническому заданию исполнителя.

Ранее уже предпринималась попытка решить эту задачу с помощью соответствующего ПО, однако добиться достаточно естественного звучания не получилось. Поэтому нужен специалист, который не просто умеет запустить обучение модели, а имеет практический опыт получения качественного результата именно с певческим голосом.

Особенно важно:

естественное звучание без металлического, роботизированного оттенка и других характерных нейросетевых артефактов;
точная передача тембра исходного голоса;
хорошая работа в разных регистрах и на разных нотах;
сохранение естественных интонаций, атаки, дыхания и динамики;
понимание того, как правильно отбирать, очищать и готовить датасет;
умение подобрать подходящую архитектуру и параметры обучения;
возможность при необходимости провести несколько итераций обучения и доводки модели.

В результате нужна готовая рабочая система, позволяющая брать качественно исполненную вокальную дорожку и преобразовывать ее в вокал заданным голосом.

Предпочтительный формат работы — сначала небольшое оплачиваемое тестовое задание. Предоставляется короткий фрагмент исходного материала и вокальной партии продолжительностью примерно 20–30 секунд. По качеству результата принимается решение о дальнейшей работе над полноценной моделью.

Тест нужен прежде всего для оценки естественности голоса. Важен не сам факт успешной конвертации, а то, насколько убедительно результат звучит как живое вокальное исполнение.

В отклике желательно указать:

С какими технологиями Singing Voice Conversion вы работаете.
Есть ли опыт именно с пением, а не только с синтезом или клонированием речи.
Примеры вокала до и после обработки, желательно выполненные лично вами.
Какой исходный материал потребуется и в каком объеме.
Какой подход вы предлагаете использовать для достижения естественного звучания.
Что будет передано в результате: обученная модель, необходимые файлы, настроенное ПО или интерфейс, инструкция по использованию.
Стоимость тестового задания.
Ориентировочную стоимость полной работы.

Ключевой критерий — качество звучания. Модель, которая технически работает, но дает явно искусственный, металлический или «нейросетевой» вокал, задачу не решает.
Опубликован 20.08.2026 в 08:04 Последнее изменение: 19.08.2026 в 22:10

Выберите способ верификации:

Обновите страницу после прохождения верификации.