AMR у текст: розшифрування аудіо

Безкоштовно, без ліміту хвилин, без облікового запису. Розпізнавання мовлення працює на вашому пристрої: запис ніколи не вивантажується.

🔒 Розпізнавання мовлення працює в браузері. Воно завантажується лише один раз; ваш запис нікуди не надсилається.

Перетягніть запис AMR вище й отримайте його текст за кілька секунд чи хвилин. Розпізнавання мовлення працює в браузері: аудіо ніколи не вивантажується, без обмеження тривалості й без облікового запису.

Що ви отримуєте

  • Це розпізнавання мовлення, а не зміна формату: воно слухає запис і записує сказане, з пунктуацією та великими літерами.
  • Текст ділиться на абзаци за паузами. Мітки часу лишаються на екрані та в експорті SRT і VTT.
  • Близько сотні мов, визначаються автоматично. Мовлення також можна перекласти англійською.
  • Чітке мовлення розпізнається майже ідеально. Фоновий шум, одночасне мовлення та рідкісні імена дають помилки, які можна виправити на місці до завантаження.
  • Мовців не позначено: текст передає, що було сказано, а не ким.

Коли конвертувати, а коли ні

Простий текст підходить для нотаток, протоколів, цитат з інтерв'ю, голосового повідомлення, яке зараз не можна прослухати, або всього, що потрібно шукати, копіювати чи перекладати.

Оскільки нічого не вивантажується, це підходить для конфіденційних записів: медичних, юридичних, співбесід або особистих голосових нотаток.

Як це зробити

  1. Перетягніть файл AMR вище або натисніть, щоб обрати.
  2. Залиште автовизначення мови й оберіть режим: Fast працює скрізь, Accurate найкращий на комп'ютері із сучасним браузером.
  3. Натисніть «Розшифрувати». Читайте текст у міру появи, виправляйте будь-яке слово клацанням, потім завантажте TXT, SRT або VTT.

Запитання

Мій файл AMR вивантажується?

Ні. Розпізнавання мовлення один раз завантажується в браузер і працює там. Сам запис ніколи не залишає пристрій: після завантаження можна вимкнути інтернет, і все продовжить працювати.

Наскільки це точно?

При чіткому мовленні Accurate майже не помиляється; Fast помиляється частіше, але працює на будь-якому телефоні, а Balanced десь посередині. Будь-який рядок можна виправити до завантаження.

Скільки часу це займає?

На сучасному комп'ютері хвилина мовлення обробляється за кілька секунд у режимі Fast чи Accurate і трохи довше в Balanced. Телефони повільніші. Тиша пропускається, тож довгий запис із паузами обробляється швидше, ніж можна подумати за його тривалістю.

Чому першого разу щось завантажується?

Розпізнавати мовлення на пристрої означає завантажити саме розпізнавання: 80 МБ для Fast, 245 МБ для Balanced, 545 МБ для Accurate. Воно зберігається в браузері, тож наступні розшифрування починаються одразу.

Які мови підтримуються?

Близько сотні, зокрема англійська, французька, іспанська, німецька, італійська, португальська, нідерландська, арабська, китайська, японська й українська. Мова визначається автоматично; її можна вказати й вручну.

Це безкоштовно? Чи є обмеження тривалості?

Безкоштовно, без облікового запису й без ліміту хвилин: роботу виконує ваш пристрій, тож рахувати нема чого. Дуже довгі записи обмежує лише пам'ять пристрою.