Перетворіть голосове повідомлення WhatsApp на текст

Прочитайте голосове замість того, щоб слухати. Перетягніть файл .opus або .ogg: він розшифровується на вашому пристрої й ніколи не надсилається на сервер.

🔒 Розпізнавання мовлення працює в браузері. Воно завантажується лише один раз; ваш запис нікуди не надсилається.

Розшифруйте голосове повідомлення, не виходячи з WhatsApp

Встановіть AnyFileFormat як застосунок, і він з'явиться в меню «Поділитися» на телефоні. Голосове повідомлення розшифровується на вашому пристрої й нікуди не надсилається.

  1. Встановіть застосунок (один раз).
  2. У WhatsApp або Telegram натисніть і утримуйте голосове повідомлення, потім натисніть «Поділитися».
  3. Оберіть AnyFileFormat: розшифрування почнеться саме.

Як це зробити

  1. Збережіть голосове повідомлення з WhatsApp (як, див. нижче).
  2. Перетягніть сюди файл .opus, .ogg або .m4a.
  3. Прочитайте текст за кілька секунд, скопіюйте або завантажте його.

Перетягніть запис голосове повідомлення WhatsApp вище й отримайте його текст за кілька секунд чи хвилин. Розпізнавання мовлення працює в браузері: аудіо ніколи не вивантажується, без обмеження тривалості й без облікового запису.

Що ви отримуєте

  • Це розпізнавання мовлення, а не зміна формату: воно слухає запис і записує сказане, з пунктуацією та великими літерами.
  • Текст ділиться на абзаци за паузами. Мітки часу лишаються на екрані та в експорті SRT і VTT.
  • Близько сотні мов, визначаються автоматично. Мовлення також можна перекласти англійською.
  • Чітке мовлення розпізнається майже ідеально. Фоновий шум, одночасне мовлення та рідкісні імена дають помилки, які можна виправити на місці до завантаження.
  • Мовців не позначено: текст передає, що було сказано, а не ким.

Для чого він потрібен

Простий текст підходить для нотаток, протоколів, цитат з інтерв'ю, голосового повідомлення, яке зараз не можна прослухати, або всього, що потрібно шукати, копіювати чи перекладати.

Оскільки нічого не вивантажується, це підходить для конфіденційних записів: медичних, юридичних, співбесід або особистих голосових нотаток.

Часті запитання

Як дістати файл голосового повідомлення з WhatsApp?

На iPhone: натисніть і утримуйте голосове повідомлення, оберіть «Переслати», натисніть значок «Поділитися», потім «Зберегти у Файли». На Android: натисніть і утримуйте повідомлення, натисніть «Поділитися» (або три крапки, потім «Поділитися») і збережіть його у файли; отримані повідомлення також лежать у папці WhatsApp/Media/WhatsApp Voice Notes. У WhatsApp для комп'ютера або WhatsApp Web: наведіть курсор на повідомлення, відкрийте його меню й оберіть «Завантажити».

У якому форматі голосові повідомлення WhatsApp?

Звук Opus, зазвичай збережений як .opus або .ogg. Обидва формати читаються тут напряму, як і .m4a та .mp3, якщо ви вже конвертували повідомлення.

Чи можна розшифрувати голосове повідомлення прямо з WhatsApp?

На Android так: встановіть AnyFileFormat як застосунок (кнопка на цій сторінці), потім у WhatsApp або Telegram натисніть і утримуйте голосове повідомлення, натисніть «Поділитися» й оберіть AnyFileFormat. Розшифрування почнеться саме, на вашому телефоні. iPhone поки не дозволяє вебзастосункам отримувати спільні файли, тож там спершу збережіть повідомлення у «Файли».

Чи дізнається відправник, що я розшифрував повідомлення?

Ні. Нічого не надсилається ні в WhatsApp, ні комусь іще: файл читається й розшифровується всередині вашого браузера.

Мій файл голосове повідомлення WhatsApp вивантажується?

Ні. Розпізнавання мовлення один раз завантажується в браузер і працює там. Сам запис ніколи не залишає пристрій: після завантаження можна вимкнути інтернет, і все продовжить працювати.

Наскільки це точно?

При чіткому мовленні Accurate майже не помиляється; Fast помиляється частіше, але працює на будь-якому телефоні, а Balanced десь посередині. Будь-який рядок можна виправити до завантаження.

Скільки часу це займає?

На сучасному комп'ютері хвилина мовлення обробляється за кілька секунд у режимі Fast чи Accurate і трохи довше в Balanced. Телефони повільніші. Тиша пропускається, тож довгий запис із паузами обробляється швидше, ніж можна подумати за його тривалістю.

Чому першого разу щось завантажується?

Розпізнавати мовлення на пристрої означає завантажити саме розпізнавання: 80 МБ для Fast, 245 МБ для Balanced, 545 МБ для Accurate. Воно зберігається в браузері, тож наступні розшифрування починаються одразу.

Які мови підтримуються?

Близько сотні, зокрема англійська, французька, іспанська, німецька, італійська, португальська, нідерландська, арабська, китайська, японська й українська. Мова визначається автоматично; її можна вказати й вручну.

Це безкоштовно? Чи є обмеження тривалості?

Безкоштовно, без облікового запису й без ліміту хвилин: роботу виконує ваш пристрій, тож рахувати нема чого. Дуже довгі записи обмежує лише пам'ять пристрою.