Перетащите видео WebM выше и получите его текст за несколько секунд или минут. Распознавание речи работает в браузере: видео никогда не загружается, без ограничения длительности и без аккаунта.
Что вы получаете
- Это распознавание речи, а не смена формата: оно слушает звуковую дорожку видео и записывает сказанное, с пунктуацией и заглавными буквами.
- Текст делится на абзацы по паузам. Метки времени остаются на экране и в экспорте SRT и VTT.
- Около сотни языков, определяются автоматически. Речь также можно перевести на английский.
- Чёткая речь распознаётся почти идеально. Фоновый шум, одновременная речь и редкие имена дают ошибки, которые можно исправить прямо на месте до скачивания.
- Говорящие не обозначаются: текст передаёт, что было сказано, а не кем.
Когда конвертировать, а когда нет
Простой текст подходит для заметок, протоколов, цитат из интервью, голосового сообщения, которое сейчас нельзя прослушать, или всего, что нужно искать, копировать или переводить.
Поскольку ничего не загружается, это подходит для конфиденциальных записей: медицинских, юридических, собеседований или личных голосовых заметок.
Как это сделать
- Перетащите файл WebM выше или нажмите, чтобы выбрать.
- Оставьте автоопределение языка и выберите режим: Fast работает везде, Accurate лучше всего на компьютере с современным браузером.
- Нажмите «Расшифровать». Читайте текст по мере появления, исправляйте любое слово щелчком, затем скачайте TXT, SRT или VTT.
Вопросы
Мой файл WebM загружается?
Нет. Распознавание речи один раз загружается в браузер и работает там. Сама запись никогда не покидает устройство: после загрузки можно отключить интернет, и всё продолжит работать.
Насколько это точно?
При чёткой речи Accurate почти не ошибается; Fast ошибается чаще, но работает на любом телефоне, а Balanced где-то посередине. Любую строку можно исправить до скачивания.
Сколько времени это занимает?
На современном компьютере минута речи обрабатывается за несколько секунд в режиме Fast или Accurate и чуть дольше в Balanced. Телефоны медленнее. Тишина пропускается, поэтому длинная запись с паузами обрабатывается быстрее, чем можно подумать по её длине.
Почему в первый раз что-то скачивается?
Распознавать речь на устройстве значит скачать само распознавание: 80 МБ для Fast, 245 МБ для Balanced, 545 МБ для Accurate. Оно хранится в браузере, поэтому следующие расшифровки начинаются сразу.
Какие языки поддерживаются?
Около сотни, включая английский, французский, испанский, немецкий, итальянский, португальский, нидерландский, арабский, китайский, японский и русский. Язык определяется автоматически; его можно указать и вручную.
Это бесплатно? Есть ли ограничение по длительности?
Бесплатно, без аккаунта и без лимита минут: работу выполняет ваше устройство, так что считать нечего. Очень длинные записи ограничены только памятью устройства.