Говорящий аватар
Загрузите фотографию и аудио с речью — нейросеть синхронизирует губы с голосом. На выходе видео, где человек со снимка говорит вашим текстом: для аватара канала, приветствия на сайте или поздравления.
Сделать говорящее видеоЗагрузите запись или вставьте ссылку на ролик — нейросеть вернёт текст с пунктуацией, отметками времени и разделением по говорящим. Готовый результат скачивается текстом или субтитрами.
Короткие разборы под конкретные задачи — с примерами формулировок и ценами.
Все инструменты работают на одном балансе — переключайтесь между ними без отдельной оплаты.
Загрузите фотографию и аудио с речью — нейросеть синхронизирует губы с голосом. На выходе видео, где человек со снимка говорит вашим текстом: для аватара канала, приветствия на сайте или поздравления.
Сделать говорящее видеоЗагрузите трек — нейросеть отделит вокал от музыки и вернёт две дорожки: чистый инструментал для караоке и отдельно голос. Ничего устанавливать не нужно.
Убрать вокалВставьте ссылку на ролик — и заберите звуковую дорожку отдельным файлом. Само видео скачивать не нужно: дорожка снимается на нашей стороне и приходит готовым файлом.
ОткрытьОпишите словами, какая нужна музыка — стиль, настроение, инструменты. Нейросеть напишет и сыграет трек: инструментал для фона видео или песню с вокалом на ваш текст. За одну генерацию приходит два разных варианта.
ОткрытьЗагрузите запись — нейросеть уберёт фоновый гул, шум улицы, шипение микрофона и оставит чистый голос. Подходит для интервью, созвонов, голосовых и звука из видео.
Очистить записьОпишите звук словами — нейросеть соберёт готовый эффект в MP3: взрывы, шаги, интерфейсные сигналы, атмосфера и бесшовные лупы.
Создать звукБольше 12 000 готовых звуков в 945 категориях — слушайте онлайн и скачивайте бесплатно в MP3.
Открыть каталогТе же инструменты из вашего кода: оживление фото, аватар, картинки, звуки и озвучка по HTTP-запросу. Ключ, JSON, оплата за запуск.
Смотреть документациюMP3, WAV, M4A, OGG и дорожка из видео — MP4 и WebM. Можно не загружать файл вовсе, а дать ссылку на ролик: звук из него будет извлечён автоматически.
На разборчивой записи — близко к дословной, со знаками препинания и заглавными буквами. Слабое место — имена собственные и узкие термины: их стоит проверить поиском по тексту. Если запись шумная, сначала прогоните её через очистку звука.
Голоса сравниваются по тембру и манере речи, каждому присваивается номер: «Говорящий 1», «Говорящий 2». Имён модель не знает — их подставляют заменой по тексту. Двух-трёх человек различает уверенно, в записи на пятерых часть реплик придётся поправить.
Текст с отметками времени и говорящими, субтитры SRT и VTT. Субтитры сразу подхватываются видеоредактором и плеером.
Три рубля за минуту записи, минимум десять рублей за обработку. Час интервью — 180 ₽ против нескольких часов ручного набора. Цена считается по настоящей длительности файла и показывается до запуска.