Превратите голосовое сообщение WhatsApp в текст

Прочитайте голосовое вместо того, чтобы слушать. Перетащите файл .opus или .ogg: он расшифровывается на вашем устройстве и никогда не отправляется на сервер.

🔒 Распознавание речи работает в браузере. Оно скачивается только один раз; ваша запись никуда не отправляется.

Расшифруйте голосовое сообщение, не выходя из WhatsApp

Установите AnyFileFormat как приложение, и оно появится в меню «Поделиться» на телефоне. Голосовое сообщение расшифровывается на вашем устройстве и никуда не отправляется.

  1. Установите приложение (один раз).
  2. В WhatsApp или Telegram нажмите и удерживайте голосовое сообщение, затем нажмите «Поделиться».
  3. Выберите AnyFileFormat: расшифровка начнётся сама.

Как это сделать

  1. Сохраните голосовое сообщение из WhatsApp (как, см. ниже).
  2. Перетащите сюда файл .opus, .ogg или .m4a.
  3. Прочитайте текст через несколько секунд, скопируйте или скачайте его.

Перетащите запись голосовое сообщение WhatsApp выше и получите её текст за несколько секунд или минут. Распознавание речи работает в браузере: аудио никогда не загружается, без ограничения длительности и без аккаунта.

Что вы получаете

  • Это распознавание речи, а не смена формата: оно слушает запись и записывает сказанное, с пунктуацией и заглавными буквами.
  • Текст делится на абзацы по паузам. Метки времени остаются на экране и в экспорте SRT и VTT.
  • Около сотни языков, определяются автоматически. Речь также можно перевести на английский.
  • Чёткая речь распознаётся почти идеально. Фоновый шум, одновременная речь и редкие имена дают ошибки, которые можно исправить прямо на месте до скачивания.
  • Говорящие не обозначаются: текст передаёт, что было сказано, а не кем.

Для чего он нужен

Простой текст подходит для заметок, протоколов, цитат из интервью, голосового сообщения, которое сейчас нельзя прослушать, или всего, что нужно искать, копировать или переводить.

Поскольку ничего не загружается, это подходит для конфиденциальных записей: медицинских, юридических, собеседований или личных голосовых заметок.

Частые вопросы

Как достать файл голосового сообщения из WhatsApp?

На iPhone: нажмите и удерживайте голосовое сообщение, выберите «Переслать», нажмите значок «Поделиться», затем «Сохранить в Файлы». На Android: нажмите и удерживайте сообщение, нажмите «Поделиться» (или три точки, затем «Поделиться») и сохраните его в файлы; полученные сообщения также лежат в папке WhatsApp/Media/WhatsApp Voice Notes. В WhatsApp для компьютера или WhatsApp Web: наведите курсор на сообщение, откройте его меню и выберите «Скачать».

В каком формате голосовые сообщения WhatsApp?

Звук Opus, обычно сохранённый как .opus или .ogg. Оба формата читаются здесь напрямую, как и .m4a и .mp3, если вы уже конвертировали сообщение.

Можно ли расшифровать голосовое сообщение прямо из WhatsApp?

На Android да: установите AnyFileFormat как приложение (кнопка на этой странице), затем в WhatsApp или Telegram нажмите и удерживайте голосовое сообщение, нажмите «Поделиться» и выберите AnyFileFormat. Расшифровка начнётся сама, на вашем телефоне. iPhone пока не позволяет веб-приложениям принимать общие файлы, поэтому там сначала сохраните сообщение в «Файлы».

Узнает ли отправитель, что я расшифровал сообщение?

Нет. Ничего не отправляется ни в WhatsApp, ни кому-либо ещё: файл читается и расшифровывается внутри вашего браузера.

Мой файл голосовое сообщение WhatsApp загружается?

Нет. Распознавание речи один раз загружается в браузер и работает там. Сама запись никогда не покидает устройство: после загрузки можно отключить интернет, и всё продолжит работать.

Насколько это точно?

При чёткой речи Accurate почти не ошибается; Fast ошибается чаще, но работает на любом телефоне, а Balanced где-то посередине. Любую строку можно исправить до скачивания.

Сколько времени это занимает?

На современном компьютере минута речи обрабатывается за несколько секунд в режиме Fast или Accurate и чуть дольше в Balanced. Телефоны медленнее. Тишина пропускается, поэтому длинная запись с паузами обрабатывается быстрее, чем можно подумать по её длине.

Почему в первый раз что-то скачивается?

Распознавать речь на устройстве значит скачать само распознавание: 80 МБ для Fast, 245 МБ для Balanced, 545 МБ для Accurate. Оно хранится в браузере, поэтому следующие расшифровки начинаются сразу.

Какие языки поддерживаются?

Около сотни, включая английский, французский, испанский, немецкий, итальянский, португальский, нидерландский, арабский, китайский, японский и русский. Язык определяется автоматически; его можно указать и вручную.

Это бесплатно? Есть ли ограничение по длительности?

Бесплатно, без аккаунта и без лимита минут: работу выполняет ваше устройство, так что считать нечего. Очень длинные записи ограничены только памятью устройства.