Аудио в текст

Голосовые, диктофон и аудиофайлы - в текст с тайм-кодами

Пришлите файл или голосовое сообщение прямо в Telegram. Бот распознаёт речь, расставляет тайм-коды и, если говорит несколько человек, разделяет реплики по голосам.

Открыть в Telegram Открыть в Max - скоро
4 форматаmp3, m4a, wav, ogg
2 ГБпо ссылке на Диск
Тайм-кодына каждую реплику

Источники

Откуда берём звук

Голосовые Telegram

Перешлите голосовое сообщение боту - обработка начинается сразу, без сохранения на диск.

Диктофон

Запись с телефона или отдельного диктофона - подойдёт стандартный mp3, m4a, wav или ogg.

Plaud

Записи с диктофона Plaud забираются из облака Plaud и идут в ту же очередь распознавания.

Файл с компьютера

Любой аудиофайл в поддерживаемом формате - просто отправьте его боту как документ.

Как это устроено

Три шага от записи до текста

  1. 01

    Отправьте запись

    Голосовое, файл или пересланное сообщение - бот принимает mp3, m4a, wav, ogg: файлом до 20 МБ, большие - ссылкой на Яндекс.Диск или Google Drive, до 2 ГБ.

  2. 02

    Бот распознаёт речь

    Расставляет тайм-код на каждую реплику и, если голосов несколько, разделяет их между собой.

  3. 03

    Получаете текст

    Расшифровка карточками с тайм-кодами, а если запись похожа на встречу - ещё и протокол с задачами.