Вокал — самая заметная часть песни и самая капризная в управлении. Разберём, что можно задать, когда нейросеть споёт песню на ваш текст.
Чем управляем
| Параметр | Как задать | Насколько слушается |
|---|---|---|
| Пол голоса | «мужской вокал», «женский вокал» | хорошо |
| Количество голосов | «дуэт», «хор в припеве» | хорошо |
| Манера | «мягко», «с надрывом», «шёпотом», «речитатив» | средне |
| Высота | «низкий голос», «высокий голос» | средне |
| Конкретный тембр | — | никак: модель не копирует голоса людей |
Как текст влияет на исполнение
- Длина строки задаёт темп пения. Короткие строки — просторное звучание, длинные — скороговорка.
- Повторы работают. Повторённая строка припева звучит как припев, а не как продолжение куплета.
- Пустая строка — граница части. Так модель понимает, где куплет, а где припев.
- Знаки препинания влияют на фразировку. Точка даёт паузу, запятая — короткий вдох.
Ударения в именах и редких словах
Имена собственные иногда поются с неожиданным ударением. Что помогает:
- Послушать оба варианта — часто в одном из них ударение верное.
- Переставить слово в строке: в другой ритмической позиции оно нередко читается правильно.
- Заменить на более распространённую форму имени.
Если нужен только инструментал
Поставьте галочку «без вокала» — модель сыграет музыку без голоса. А если вокал уже сгенерировался, но нужен минус, дорожки разделяются на голос и музыку.
Когда лучше не петь, а говорить
Для рекламы, объявлений и закадрового текста пение только мешает. Там нужен синтез речи: ровный дикторский голос, читающий ваш текст, с музыкой на фоне.
