Как спеть песню своим голосом, не умея петь
Есть песня, есть текст, нет голоса. Точнее, голос есть, но петь им страшно: слуха немного, диапазон в полторы ноты, а в записи всё это слышно особенно ясно. Клонирование голоса решает ровно эту задачу — ваш тембр остаётся, попадание в ноты берёт на себя модель.
Что вообще происходит при клонировании
Вы записываете короткий образец — десять-тридцать секунд. Модель снимает с него тембр: высоту, плотность, характер звука, манеру тянуть гласные. Дальше этим тембром можно спеть любой текст в любом жанре, даже если сами вы так не споёте никогда.
Важно понимать, что копируется именно окраска голоса, а не ваше умение петь. Модель не подражает вашим ошибкам — она поёт чисто. Поэтому результат обычно звучит как «я, только лучше», и это нормальная реакция первого прослушивания.
Образец решает всё
Девять из десяти неудачных клонов — это плохая исходная запись. Требования простые, но выполнять их надо буквально.
- Тишина. Никакой музыки на фоне, никакого телевизора в соседней комнате, окно закрыто. Модель отделить ваш голос от фона не обязана.
- Комната без эха. Ванная и пустая кухня — худшие места. Лучше комната с диваном, шторами и ковром, можно встать ближе к мягкой мебели.
- Микрофон рядом. Телефон на расстоянии ладони или наушники с микрофоном. Не через всю комнату.
- Петь, а не говорить. Образец для пения снимается с пения. Проговорённый текст даёт голос, который потом звучит плоско.
- Ровно и без надрыва. Спокойная фраза, средняя громкость. Крик и шёпот дают перекошенный тембр.
Проверка за десять секунд: послушайте свой образец в наушниках. Если слышно гул холодильника, эхо от стен или шипение — перепишите. Эти же дефекты уедут в каждую песню, спетую этим голосом.
Фраза на проверку
После образца система просит зачитать короткую фразу — её выдаёт сама модель, каждый раз новую. Это защита от клонирования чужих голосов: нельзя взять запись из интернета и сделать клон человека, который об этом не знает.
Фразу читайте целиком, чётко и не спеша. Самая частая ошибка — проглотить последнее слово или прочитать на фоне работающего телевизора. Тогда проверка не проходит, и всё приходится начинать заново.
Голос живёт недолго — пойте сразу
Практическая деталь, о которой мало кто предупреждает: созданный голос не хранится вечно. Через какое-то время модель перестаёт его принимать и просит создать заново. Иногда это часы.
Отсюда простое правило работы: создали голос — сразу же запускайте песню, а лучше две-три версии за один заход. Записывать голос «про запас», чтобы воспользоваться им через неделю, смысла нет: к тому моменту он, скорее всего, уже не примется. Хорошая новость в том, что ваш исходный образец сохраняется, и восстановление голоса занимает одну зачитанную фразу, а петь заново не нужно.
Что получается хорошо, а что нет
Хорошо выходят средние по темпу жанры, где голос на первом плане: поп, рок, шансон, баллады, рэп. Тембр узнают близкие — это главный тест.
Хуже получается всё, что требует экстремальной техники: оперный вокал, гроул, очень высокие женские партии при мужском образце. Модель попробует, но результат будет звучать как чужой голос, слегка похожий на ваш.
Отдельно про диапазон. Клон поёт примерно в тех границах, что и образец. Если записать образец шёпотом в нижнем регистре, а потом заказать энергичный припев на верхах, тембр поплывёт. Пойте образец в той же манере, в которой хотите слышать песню.
Сколько это стоит
Создание голоса — 25 ₽, разово. Песня в двух вариантах — 20 ₽ за генерацию. То есть эксперимент «а как это вообще звучит» обходится в 45 ₽ и занимает минут десять вместе с записью образца.
Для сравнения: час в студии со звукорежиссёром стоит от двух тысяч, и петь там придётся самому.
Чужие голоса — не надо
Клонировать голос известного исполнителя или знакомого без его согласия — плохая идея сразу по двум причинам. Площадки такие треки снимают по жалобе правообладателя, а история с «пранком» над знакомым перестаёт быть смешной ровно в тот момент, когда запись уходит дальше вашей переписки.
Свой голос — другое дело. Это ваш инструмент, и он даёт то, чего не даёт ни один пресет: песню, которую слышно как вашу.
Что делать дальше
Песня своим голосом — половина дела. Дальше её обычно превращают в видео: клип по сюжету песни, лирик-видео со словами на экране или короткий вертикальный ролик для Reels и Shorts. Отдельный трюк — липсинк: персонаж в кадре поёт вашим голосом с попаданием в губы. Работает сильнее любого статичного превью, потому что зритель видит источник звука.
Попробуйте сами
Загрузите свой трек или сгенерируйте музыку нейросетью. Первый клип бесплатно.
Сделать клип