Короткий ответ: да, и для этого не нужно уметь петь. Нейросеть запоминает тембр вашего голоса по короткой записи обычной речи, а затем поёт им любой текст. Разберём, что стоит за этой фразой и где у способа границы.

Что нейросеть берёт из вашей записи
Из образца модель извлекает не слова и не мелодию, а тембр — набор призвуков, по которым голос узнают на слух. Именно поэтому образцом служит обычная речь: петь в нём не нужно. Дальше тембр накладывается на синтезированное пение, и получается голос, который близкие узнают с первых секунд.
Что получится хорошо
- Поздравления. Песня, где именинника поздравляет его собственный голос, работает сильнее любой открытки.
- Семейные даты. Свадьба, юбилей, годовщина — там, где важен конкретный человек, а не абстрактный вокал.
- Гимн команды или проекта. Голос руководителя или всей команды делает песню своей.
- Демо своей песни. Автор слышит, как текст ложится на музыку, до похода в студию.
Чего ждать не стоит
Нейросеть не делает из вас профессионального вокалиста с узнаваемой манерой. Она передаёт тембр, но не привычку тянуть ноты, не характерные заломы и придыхания — то, за что любят конкретного певца. Поёт она ровно и чисто: это плюс, когда вы не попадаете в ноты, и ограничение, когда нужен именно ваш авторский стиль исполнения.
Ещё одно ограничение — язык. Русский вокал звучит уверенно, но сложные рифмы и редкие слова лучше проверять: иногда ударение встаёт не туда. Помогает разбить строку на более короткие.
Почему нельзя спеть чужим голосом
Перед созданием голоса сервис придумывает случайную фразу, которой нет в интернете, и просит прочитать её вслух. Записью из чужого ролика такую проверку не пройти: фраза каждый раз новая. Это защита и от подделки, и от жалоб — голос можно создать только свой.
Сколько это занимает
Двадцать секунд на запись образца, ещё столько же на чтение проверочной фразы, пара минут на создание голоса. Дальше каждая песня — минуты две. Голос сохраняется в кабинете, поэтому вторую и десятую песню вы делаете сразу, без повторной записи.
Частые вопросы
Нужно ли уметь петь?
Нет. Образец — это обычная речь, а петь будет нейросеть вашим тембром. Умение петь ничего не добавит к результату.
Подойдёт ли запись с телефона?
Да, диктофона телефона достаточно. Важнее тишина вокруг: без телевизора, улицы и музыки на фоне. Шумную запись лучше сначала прогнать через очистку от шума.
Можно ли петь не свою песню?
Технически да, но права на чужой текст и музыку остаются у авторов. Для публикации кавера нужны те же разрешения, что и при обычной записи.
Что если голос не понравится?
Запишите образец заново в более тихом месте и ближе к микрофону — чаще всего дело в записи, а не в модели. Голосов в кабинете можно держать несколько и выбирать при создании песни.
Создать песню своим голосом. Если голос не нужен и требуется только музыка — есть генератор музыки.
