Сделать инструментал из песни: как работает разделение дорожек

Инструментал — это исходная песня без ведущего голоса. Раньше его получали двумя способами: искали официальную версию без вокала или пытались вычесть голос инверсией фазы. Первый вариант существует у единиц треков, второй убивает и голос, и половину музыки вместе с ним.

Почему старые способы не работают

Инверсия фазы вычитает то, что одинаково в левом и правом канале. Голос обычно стоит по центру, поэтому он действительно приглушается — но вместе с ним исчезают бас, бочка и малый барабан, которые тоже сведены по центру. На выходе получается глухой трек с провалом в середине.

Как это делает нейросеть

Модель обучена на тысячах песен, где отдельно известны голос и музыка. Она не вычитает, а заново собирает каждую дорожку: узнаёт, как звучит голос, и восстанавливает то, что под ним было. Поэтому бас и барабаны остаются на месте, а инструментал звучит полным.

Какого качества ждать

Исходник Результат
WAV или MP3 320 kbps чистый инструментал, артефакты почти не слышны
MP3 192 kbps хорошо, лёгкий «призвук» на верхах
MP3 128 kbps и ниже заметные артефакты: то, чего нет в файле, восстановить нельзя
Запись с телефона или из видео результат хуже — сначала стоит убрать шум

Что будет с бэк-вокалом

Подпевки и хоры обычно уходят вместе с основным голосом: для модели это тоже вокал. Если нужен инструментал именно с бэками, лучше просить разделение на несколько дорожек — тогда бэк-вокал можно вернуть отдельным слоем при сведении.

Как получить

Загрузите трек в сервис удаления вокала. На выходе две дорожки — инструментал и голос отдельно. Цена считается по длительности: 15 ₽ за минуту, минимум 45 ₽. Файл до 20 МБ и до 10 минут.

Читать  Почистить аудиозапись онлайн: без программ и настроек

Частые вопросы

Можно ли использовать инструментал публично? Права на песню остаются у правообладателя: разделение дорожек не делает вас автором. Для выступлений, каверов и публикаций нужны те же разрешения, что и для оригинала.

Почему остаётся «эхо» голоса? Это реверберация: хвост голоса в записи живёт дольше самого голоса и частично принадлежит комнате. На плотных миксах его слышно чаще.

Сколько ждать? В ручном режиме — до пятнадцати минут; готовые дорожки приходят в историю и на почту.

Сделать инструментал.