Говорящий аватар
Загрузите фотографию и аудио с речью — нейросеть синхронизирует губы с голосом. На выходе видео, где человек со снимка говорит вашим текстом: для аватара канала, приветствия на сайте или поздравления.
Сделать говорящее видеоЗагрузите запись — нейросеть уберёт фоновый гул, шум улицы, шипение микрофона и оставит чистый голос. Подходит для интервью, созвонов, голосовых и звука из видео.
Сейчас записи обрабатываются в ручном режиме, поэтому результат приходит не мгновенно: обычно в течение 15 минут. Готовые дорожки появятся в вашей истории и придут на почту — страницу можно закрыть. Если обработать не получится, деньги вернутся на баланс.
Короткие разборы под конкретные задачи — с примерами формулировок и ценами.
Все инструменты работают на одном балансе — переключайтесь между ними без отдельной оплаты.
Загрузите фотографию и аудио с речью — нейросеть синхронизирует губы с голосом. На выходе видео, где человек со снимка говорит вашим текстом: для аватара канала, приветствия на сайте или поздравления.
Сделать говорящее видеоЗагрузите трек — нейросеть отделит вокал от музыки и вернёт две дорожки: чистый инструментал для караоке и отдельно голос. Ничего устанавливать не нужно.
Убрать вокалЗагрузите запись или вставьте ссылку на ролик — нейросеть вернёт текст с пунктуацией, отметками времени и разделением по говорящим. Готовый результат скачивается текстом или субтитрами.
ОткрытьВставьте ссылку на ролик — и заберите звуковую дорожку отдельным файлом. Само видео скачивать не нужно: дорожка снимается на нашей стороне и приходит готовым файлом.
ОткрытьОпишите словами, какая нужна музыка — стиль, настроение, инструменты. Нейросеть напишет и сыграет трек: инструментал для фона видео или песню с вокалом на ваш текст. За одну генерацию приходит два разных варианта.
ОткрытьОпишите звук словами — нейросеть соберёт готовый эффект в MP3: взрывы, шаги, интерфейсные сигналы, атмосфера и бесшовные лупы.
Создать звукБольше 12 000 готовых звуков в 945 категориях — слушайте онлайн и скачивайте бесплатно в MP3.
Открыть каталогТе же инструменты из вашего кода: оживление фото, аватар, картинки, звуки и озвучка по HTTP-запросу. Ключ, JSON, оплата за запуск.
Смотреть документациюРовный фон — гул техники, кондиционер, шум улицы и трафика, шипение дешёвого микрофона, ветер. Отделяет речь от фона целиком, а не режет частоты, поэтому голос не становится «подводным».
Сильную реверберацию комнаты нейросеть заметно уменьшает, но полностью «сухим» голос из гулкого помещения не сделает. Чем ближе микрофон был ко рту, тем лучше результат.
Извлеките аудиодорожку любым конвертером, очистите её здесь и подставьте обратно в монтаже. Форматы MP4 и OGG тоже принимаются напрямую.
На выходе MP3 с исходной длительностью. Речь становится разборчивее, но нейросеть не добавляет того, чего в записи не было: полностью заглушенные шумом слова не восстановятся.