Аудио в текст
Голосовые, диктофон и аудиофайлы - в текст с тайм-кодами
Пришлите файл или голосовое сообщение прямо в Telegram. Бот распознаёт речь, расставляет тайм-коды и, если говорит несколько человек, разделяет реплики по голосам.
Источники
Откуда берём звук
Голосовые Telegram
Перешлите голосовое сообщение боту - обработка начинается сразу, без сохранения на диск.
Диктофон
Запись с телефона или отдельного диктофона - подойдёт стандартный mp3, m4a, wav или ogg.
Plaud
Записи с диктофона Plaud забираются из облака Plaud и идут в ту же очередь распознавания.
Файл с компьютера
Любой аудиофайл в поддерживаемом формате - просто отправьте его боту как документ.
Как это устроено
Три шага от записи до текста
-
01
Отправьте запись
Голосовое, файл или пересланное сообщение - бот принимает mp3, m4a, wav, ogg: файлом до 20 МБ, большие - ссылкой на Яндекс.Диск или Google Drive, до 2 ГБ.
-
02
Бот распознаёт речь
Расставляет тайм-код на каждую реплику и, если голосов несколько, разделяет их между собой.
-
03
Получаете текст
Расшифровка карточками с тайм-кодами, а если запись похожа на встречу - ещё и протокол с задачами.