Речь в текст

Расшифровка аудио в текст онлайн: с таймкодами и по говорящим

Загрузите запись или вставьте ссылку на ролик — нейросеть вернёт текст с пунктуацией, отметками времени и разделением по говорящим. Готовый результат скачивается текстом или субтитрами.

3 ₽ за минуту записи, минимум 10 ₽ без установки программ результат сразу скачивается
MP3, WAV, M4A, OGG, а также MP4 и WebM. До 10 МБ и 120 минут.
Годится и прямая ссылка на файл, и ссылка на ролик — дорожку достанем сами.
На коротких записях явный язык заметно повышает точность.
Для интервью, совещаний и подкастов.
Смех, музыка, аплодисменты — пометками в тексте.

Как это работает

  1. 1 Загрузите запись или вставьте ссылку на ролик.
  2. 2 Укажите язык и включите разделение по говорящим, если в записи несколько человек.
  3. 3 Через пару минут заберите текст, субтитры SRT или VTT.

Частые задачи с расшифровкой записей

Короткие разборы под конкретные задачи — с примерами формулировок и ценами.

Другие инструменты со звуком

Все инструменты работают на одном балансе — переключайтесь между ними без отдельной оплаты.

Говорящий аватар

Загрузите фотографию и аудио с речью — нейросеть синхронизирует губы с голосом. На выходе видео, где человек со снимка говорит вашим текстом: для аватара канала, приветствия на сайте или поздравления.

Сделать говорящее видео

Убрать вокал

Загрузите трек — нейросеть отделит вокал от музыки и вернёт две дорожки: чистый инструментал для караоке и отдельно голос. Ничего устанавливать не нужно.

Убрать вокал

Звук из видео

Вставьте ссылку на ролик — и заберите звуковую дорожку отдельным файлом. Само видео скачивать не нужно: дорожка снимается на нашей стороне и приходит готовым файлом.

Открыть

Создать музыку

Опишите словами, какая нужна музыка — стиль, настроение, инструменты. Нейросеть напишет и сыграет трек: инструментал для фона видео или песню с вокалом на ваш текст. За одну генерацию приходит два разных варианта.

Открыть

Убрать шум

Загрузите запись — нейросеть уберёт фоновый гул, шум улицы, шипение микрофона и оставит чистый голос. Подходит для интервью, созвонов, голосовых и звука из видео.

Очистить запись

Создать звук

Опишите звук словами — нейросеть соберёт готовый эффект в MP3: взрывы, шаги, интерфейсные сигналы, атмосфера и бесшовные лупы.

Создать звук

Частые вопросы

Какие файлы принимаются?

MP3, WAV, M4A, OGG и дорожка из видео — MP4 и WebM. Можно не загружать файл вовсе, а дать ссылку на ролик: звук из него будет извлечён автоматически.

Насколько точная расшифровка?

На разборчивой записи — близко к дословной, со знаками препинания и заглавными буквами. Слабое место — имена собственные и узкие термины: их стоит проверить поиском по тексту. Если запись шумная, сначала прогоните её через очистку звука.

Как работает разделение по говорящим?

Голоса сравниваются по тембру и манере речи, каждому присваивается номер: «Говорящий 1», «Говорящий 2». Имён модель не знает — их подставляют заменой по тексту. Двух-трёх человек различает уверенно, в записи на пятерых часть реплик придётся поправить.

Что можно скачать?

Текст с отметками времени и говорящими, субтитры SRT и VTT. Субтитры сразу подхватываются видеоредактором и плеером.

Сколько это стоит?

Три рубля за минуту записи, минимум десять рублей за обработку. Час интервью — 180 ₽ против нескольких часов ручного набора. Цена считается по настоящей длительности файла и показывается до запуска.