Говорящий аватар
Загрузите фотографию и аудио с речью — нейросеть синхронизирует губы с голосом. На выходе видео, где человек со снимка говорит вашим текстом: для аватара канала, приветствия на сайте или поздравления.
Сделать говорящее видеоЗагрузите ролик и вставьте текст новой озвучки — нейросеть проговорит его голосом диктора и подгонит движение губ под новую речь. Нужен перевод на другой язык — отметьте нужный, текст переведём перед озвучкой.
Все инструменты работают на одном балансе — переключайтесь между ними без отдельной оплаты.
Загрузите фотографию и аудио с речью — нейросеть синхронизирует губы с голосом. На выходе видео, где человек со снимка говорит вашим текстом: для аватара канала, приветствия на сайте или поздравления.
Сделать говорящее видеоЗагрузите трек — нейросеть отделит вокал от музыки и вернёт две дорожки: чистый инструментал для караоке и отдельно голос. Ничего устанавливать не нужно.
Убрать вокалЗагрузите запись или вставьте ссылку на ролик — нейросеть вернёт текст с пунктуацией, отметками времени и разделением по говорящим. Готовый результат скачивается текстом или субтитрами.
ОткрытьВставьте ссылку на ролик — и заберите звуковую дорожку отдельным файлом. Само видео скачивать не нужно: дорожка снимается на нашей стороне и приходит готовым файлом.
ОткрытьЗапишите двадцать секунд своего голоса, прочитайте проверочную фразу — и нейросеть научится петь вашим голосом. Дальше пишете текст песни, а поёт её ваш собственный голос. Голос сохраняется в кабинете: следующие песни делаются в один шаг.
ОткрытьОпишите словами, какая нужна музыка — стиль, настроение, инструменты. Нейросеть напишет и сыграет трек: инструментал для фона видео или песню с вокалом на ваш текст. За одну генерацию приходит два разных варианта.
ОткрытьОпишите, о чём песня и каким должно быть настроение, — нейросеть напишет слова со структурой: куплеты, припев, бридж. Приходит два разных варианта, чтобы было из чего выбрать.
ОткрытьОпишите, о чём трек и каким должно быть настроение, — нейросеть нарисует обложку. Квадрат под стриминги, широкий кадр под видео или вертикаль под сторис: размер выбираете сами.
ОткрытьЗагрузите ролик — нейросеть уберёт шум и цифровое «мыло» от пережатия, вернёт резкость мелким деталям. Подходит для старых записей, съёмки в темноте и видео, которое испортил мессенджер.
ОткрытьЗагрузите запись — нейросеть уберёт фоновый гул, шум улицы, шипение микрофона и оставит чистый голос. Подходит для интервью, созвонов, голосовых и звука из видео.
Очистить записьОпишите звук словами — нейросеть соберёт готовый эффект в MP3: взрывы, шаги, интерфейсные сигналы, атмосфера и бесшовные лупы.
Создать звук14 128 готовых звуков в 1065 подборках — слушайте онлайн и скачивайте бесплатно в MP3.
Открыть каталогИнструментальные треки без слов для видео, роликов и подкастов: 4992 звука в 369 подборках.
Слушать музыкуТе же инструменты из вашего кода: оживление фото, аватар, картинки, звуки и озвучка по HTTP-запросу. Ключ, JSON, оплата за запуск.
Смотреть документациюЧастые задачи: оживить фото, аудио в текст, музыка для видео, песня нейросетью, аудио с youtube, звук из рилс.
Проговаривает ваш текст голосом диктора и перерисовывает движение губ человека в кадре под новую речь. Остальная картинка остаётся прежней: поза, жесты, фон и монтаж не трогаются.
Речь из записи мы пока не распознаём автоматически: для этого нужна звуковая дорожка отдельным файлом. Текст вы вставляете сами — заодно вы видите, что именно прозвучит, и можете поправить формулировку до списания денег.
Прочитайте текст вслух по секундомеру. Примерно 12–15 слов на десять секунд — нормальный темп. Текст короче ролика не страшен: в конце будет тишина. Текст длиннее — уже проблема: губы разойдутся со звуком.
Двенадцать рублей за секунду видео, минимум сто пятьдесят рублей. Полминуты — 360 ₽, минута — 720 ₽. Цена считается по настоящей длительности файла и показывается до запуска.
Такое, где лицо видно целиком и крупно, человек смотрит примерно в камеру и не закрывает рот рукой или микрофоном. На дальнем плане и в профиль губы перерисовываются хуже.
Обычно две-четыре минуты: сначала делается озвучка, потом по ней перерисовывается артикуляция. Страницу можно не держать открытой — результат сохранится.
Войдите, чтобы продолжить. Форма на странице сохранится — после входа вы останетесь здесь же.