Як це зробити
- Перетягніть аудіо- або відеофайл.
- Залиште автовизначення мови й оберіть режим: Fast, Balanced або Accurate.
- Розшифруйте, виправте будь-яке слово на місці, потім скопіюйте текст або завантажте TXT, SRT чи VTT.
Перетягніть запис аудіо вище й отримайте його текст за кілька секунд чи хвилин. Розпізнавання мовлення працює в браузері: аудіо ніколи не вивантажується, без обмеження тривалості й без облікового запису.
Що ви отримуєте
- Це розпізнавання мовлення, а не зміна формату: воно слухає запис і записує сказане, з пунктуацією та великими літерами.
- Текст ділиться на абзаци за паузами. Мітки часу лишаються на екрані та в експорті SRT і VTT.
- Близько сотні мов, визначаються автоматично. Мовлення також можна перекласти англійською.
- Чітке мовлення розпізнається майже ідеально. Фоновий шум, одночасне мовлення та рідкісні імена дають помилки, які можна виправити на місці до завантаження.
- Мовців не позначено: текст передає, що було сказано, а не ким.
Для чого він потрібен
Простий текст підходить для нотаток, протоколів, цитат з інтерв'ю, голосового повідомлення, яке зараз не можна прослухати, або всього, що потрібно шукати, копіювати чи перекладати.
Оскільки нічого не вивантажується, це підходить для конфіденційних записів: медичних, юридичних, співбесід або особистих голосових нотаток.
Часті запитання
Мій файл аудіо вивантажується?
Ні. Розпізнавання мовлення один раз завантажується в браузер і працює там. Сам запис ніколи не залишає пристрій: після завантаження можна вимкнути інтернет, і все продовжить працювати.
Наскільки це точно?
При чіткому мовленні Accurate майже не помиляється; Fast помиляється частіше, але працює на будь-якому телефоні, а Balanced десь посередині. Будь-який рядок можна виправити до завантаження.
Скільки часу це займає?
На сучасному комп'ютері хвилина мовлення обробляється за кілька секунд у режимі Fast чи Accurate і трохи довше в Balanced. Телефони повільніші. Тиша пропускається, тож довгий запис із паузами обробляється швидше, ніж можна подумати за його тривалістю.
Чому першого разу щось завантажується?
Розпізнавати мовлення на пристрої означає завантажити саме розпізнавання: 80 МБ для Fast, 245 МБ для Balanced, 545 МБ для Accurate. Воно зберігається в браузері, тож наступні розшифрування починаються одразу.
Які мови підтримуються?
Близько сотні, зокрема англійська, французька, іспанська, німецька, італійська, португальська, нідерландська, арабська, китайська, японська й українська. Мова визначається автоматично; її можна вказати й вручну.
Це безкоштовно? Чи є обмеження тривалості?
Безкоштовно, без облікового запису й без ліміту хвилин: роботу виконує ваш пристрій, тож рахувати нема чого. Дуже довгі записи обмежує лише пам'ять пристрою.