Липсинк по фото и голосу

Говорящий аватар из фото: видео, где человек со снимка говорит

Загрузите фотографию и аудио с речью — нейросеть синхронизирует губы с голосом. На выходе видео, где человек со снимка говорит вашим текстом: для аватара канала, приветствия на сайте или поздравления.

12 ₽ за секунду видео, минимум 120 ₽ без установки программ результат сразу скачивается
JPEG или PNG, до 10 МБ. Лицо анфас, крупно.
MP3, WAV, M4A или OGG. До 10 МБ и 60 секунд.
Необязательно: опишите манеру речи или план кадра — например «спокойно рассказывает, крупный план».

Как это работает

  1. 1 Загрузите портрет: лицо крупно, анфас, без очков и головных уборов.
  2. 2 Добавьте аудио с речью — своё или сгенерированное в озвучке.
  3. 3 Нажмите «Сделать видео» и подождите: ролик собирается несколько минут.

Частые задачи с говорящим аватаром

Короткие разборы под конкретные задачи — с примерами формулировок и ценами.

Другие инструменты со звуком

Все инструменты работают на одном балансе — переключайтесь между ними без отдельной оплаты.

Убрать вокал

Загрузите трек — нейросеть отделит вокал от музыки и вернёт две дорожки: чистый инструментал для караоке и отдельно голос. Ничего устанавливать не нужно.

Убрать вокал

Убрать шум

Загрузите запись — нейросеть уберёт фоновый гул, шум улицы, шипение микрофона и оставит чистый голос. Подходит для интервью, созвонов, голосовых и звука из видео.

Очистить запись

Создать звук

Опишите звук словами — нейросеть соберёт готовый эффект в MP3: взрывы, шаги, интерфейсные сигналы, атмосфера и бесшовные лупы.

Создать звук

Частые вопросы

Какое фото подойдёт, чтобы оживить его нейросетью?

Лучше всего работает портрет анфас, где лицо занимает заметную часть кадра и хорошо освещено. Форматы JPEG и PNG, до 10 МБ. Снимки в профиль, в тёмных очках или с перекрытым ртом дают заметно хуже результат.

Можно ли сделать говорящее видео из старого фото?

Да, старые и отсканированные снимки работают, если лицо различимо. Архивную фотографию лучше сначала восстановить и повысить резкость в разделе «Нейросети», а уже потом загружать сюда для озвучки.

Где взять голос для видео?

Подойдёт любая запись речи до 5 минут: диктофон, кружок из мессенджера или файл из нашей озвучки текста. Если запись шумная, прогоните её через очистку звука — липсинк будет точнее.

Сколько длится генерация?

Обычно от одной до нескольких минут, в зависимости от длины аудио. Страницу можно не держать открытой: готовый ролик остаётся в истории.