Сделать говорящего аватара из фотографии: инструкция за 5 минут

Инструкция рассчитана на то, что у вас уже есть фотография и текст. Весь путь занимает около пяти минут, из них три уходят на ожидание генерации.

Подготовка (1 минута)

  • Выберите снимок анфас с хорошо видимым лицом.
  • Подготовьте текст. Ориентир: 60 секунд речи — это 800–900 знаков.
  • Решите, чей голос: свой или синтезированный.

Получить дорожку (1 минута)

Если голос свой — запишите его на телефон и при необходимости очистите от шума. Если синтезированный — соберите дорожку в озвучке текста и скачайте MP3.

Собрать ролик (3 минуты)

Откройте говорящего аватара, загрузите фото и аудио. При желании добавьте описание: «спокойно рассказывает, крупный план». Нажмите «Сделать видео». Цена показывается сразу после загрузки аудио — она зависит от длительности.

Проверить перед публикацией

Что смотреть Признак проблемы
Синхронность губ отставание на паузах — обычно из-за музыки в дорожке
Глаза полное отсутствие моргания — попробуйте другое фото
Края лица дрожание контура — лицо слишком мелкое в кадре
Звук шум и эхо — очистите дорожку и пересоберите

Что делать, если не понравилось

Меняйте по одному параметру за раз: сначала фото, потом дорожку, потом описание сцены. Так вы поймёте, что именно влияет. Чаще всего решает фотография.

Частые вопросы

Сколько стоит попробовать? Минимальный ролик до 10 секунд — 120 ₽.

Где потом лежит файл? В истории аккаунта, скачивается в MP4.

Можно ли сделать вертикальный ролик? Формат берётся из фотографии: загрузите вертикальный кадр — получите вертикальное видео.

Начать.