Можно ли создать песню со своим голосом: что умеет нейросеть

Короткий ответ: да, и для этого не нужно уметь петь. Нейросеть запоминает тембр вашего голоса по короткой записи обычной речи, а затем поёт им любой текст. Разберём, что стоит за этой фразой и где у способа границы.

Можно ли создать песню со своим голосом: голос превращается в музыку
Можно ли создать песню со своим голосом: голос превращается в музыку

Что нейросеть берёт из вашей записи

Из образца модель извлекает не слова и не мелодию, а тембр — набор призвуков, по которым голос узнают на слух. Именно поэтому образцом служит обычная речь: петь в нём не нужно. Дальше тембр накладывается на синтезированное пение, и получается голос, который близкие узнают с первых секунд.

Что получится хорошо

  • Поздравления. Песня, где именинника поздравляет его собственный голос, работает сильнее любой открытки.
  • Семейные даты. Свадьба, юбилей, годовщина — там, где важен конкретный человек, а не абстрактный вокал.
  • Гимн команды или проекта. Голос руководителя или всей команды делает песню своей.
  • Демо своей песни. Автор слышит, как текст ложится на музыку, до похода в студию.

Чего ждать не стоит

Нейросеть не делает из вас профессионального вокалиста с узнаваемой манерой. Она передаёт тембр, но не привычку тянуть ноты, не характерные заломы и придыхания — то, за что любят конкретного певца. Поёт она ровно и чисто: это плюс, когда вы не попадаете в ноты, и ограничение, когда нужен именно ваш авторский стиль исполнения.

Ещё одно ограничение — язык. Русский вокал звучит уверенно, но сложные рифмы и редкие слова лучше проверять: иногда ударение встаёт не туда. Помогает разбить строку на более короткие.

Почему нельзя спеть чужим голосом

Перед созданием голоса сервис придумывает случайную фразу, которой нет в интернете, и просит прочитать её вслух. Записью из чужого ролика такую проверку не пройти: фраза каждый раз новая. Это защита и от подделки, и от жалоб — голос можно создать только свой.

Читать  Фоновый звук для видео: как сгенерировать нужную атмосферу

Сколько это занимает

Двадцать секунд на запись образца, ещё столько же на чтение проверочной фразы, пара минут на создание голоса. Дальше каждая песня — минуты две. Голос сохраняется в кабинете, поэтому вторую и десятую песню вы делаете сразу, без повторной записи.

Частые вопросы

Нужно ли уметь петь?

Нет. Образец — это обычная речь, а петь будет нейросеть вашим тембром. Умение петь ничего не добавит к результату.

Подойдёт ли запись с телефона?

Да, диктофона телефона достаточно. Важнее тишина вокруг: без телевизора, улицы и музыки на фоне. Шумную запись лучше сначала прогнать через очистку от шума.

Можно ли петь не свою песню?

Технически да, но права на чужой текст и музыку остаются у авторов. Для публикации кавера нужны те же разрешения, что и при обычной записи.

Что если голос не понравится?

Запишите образец заново в более тихом месте и ближе к микрофону — чаще всего дело в записи, а не в модели. Голосов в кабинете можно держать несколько и выбирать при создании песни.

Создать песню своим голосом. Если голос не нужен и требуется только музыка — есть генератор музыки.