Letakkan rekaman WAV di atas dan Anda mendapatkan teksnya dalam beberapa detik hingga beberapa menit. Pengenalan ucapan berjalan di browser Anda: audio tidak pernah diunggah, tanpa batas durasi, dan tanpa akun.
Yang Anda dapatkan
- Ini pengenalan ucapan, bukan perubahan format: alat ini mendengarkan rekaman dan menuliskan apa yang diucapkan, lengkap dengan tanda baca dan huruf kapital.
- Teks dibagi menjadi paragraf pada setiap jeda. Stempel waktu tetap ditampilkan di layar, serta dalam ekspor SRT dan VTT.
- Sekitar seratus bahasa, terdeteksi secara otomatis. Ucapan juga bisa diterjemahkan ke bahasa Inggris.
- Ucapan yang jelas menghasilkan teks yang nyaris sempurna. Kebisingan latar, orang yang berbicara bersamaan, dan nama yang jarang dapat menimbulkan kesalahan, yang bisa Anda perbaiki langsung sebelum mengunduh.
- Pembicara tidak diberi label: teks menunjukkan apa yang dikatakan, bukan siapa yang mengatakannya.
Kapan sebaiknya mengonversi, dan kapan tidak
Gunakan teks biasa untuk catatan, notula, kutipan wawancara, pesan suara yang tidak bisa Anda dengarkan saat ini, atau apa pun yang ingin Anda cari, salin, atau terjemahkan.
Karena tidak ada yang diunggah, alat ini cocok untuk rekaman rahasia: wawancara medis, hukum, SDM, atau catatan suara pribadi.
Cara melakukannya
- Letakkan file WAV Anda di atas, atau klik untuk memilihnya.
- Biarkan bahasa pada deteksi otomatis, lalu pilih mode: Fast berfungsi di mana saja, Accurate paling baik di komputer dengan browser terbaru.
- Klik Transkripsi. Baca teksnya saat muncul, perbaiki kata mana pun dengan mengkliknya, lalu unduh TXT, SRT, atau VTT.
Pertanyaan
Apakah file WAV saya diunggah?
Tidak. Pengenalan ucapan diunduh ke browser Anda sekali dan dijalankan di sana. Rekamannya sendiri tidak pernah meninggalkan perangkat Anda: setelah dimuat, Anda bisa memutus koneksi internet dan semuanya tetap berfungsi.
Seberapa akurat hasilnya?
Pada suara yang jelas, Accurate hanya membuat sedikit kesalahan; Fast membuat lebih banyak kesalahan tetapi berjalan di ponsel apa pun, dan Balanced berada di antaranya. Setiap baris bisa diperbaiki sebelum Anda mengunduh.
Berapa lama prosesnya?
Di komputer yang cukup baru, satu menit ucapan butuh beberapa detik dengan Fast atau Accurate, dan sedikit lebih lama dengan Balanced. Ponsel lebih lambat. Bagian hening dilewati, jadi rekaman panjang dengan banyak jeda diproses lebih cepat daripada durasinya.
Mengapa ada unduhan saat pertama kali?
Mengenali ucapan di perangkat Anda berarti mengunduh komponen pengenalannya: 80 MB untuk Fast, 245 MB untuk Balanced, 545 MB untuk Accurate. Komponen ini disimpan di browser Anda, sehingga transkripsi berikutnya langsung dimulai.
Bahasa apa saja yang didukung?
Sekitar seratus bahasa, termasuk Inggris, Prancis, Spanyol, Jerman, Italia, Portugis, Belanda, Arab, Tionghoa, Jepang, dan Rusia. Bahasa terdeteksi secara otomatis; Anda juga bisa memilihnya sendiri.
Apakah gratis? Apakah ada batas durasi?
Gratis, tanpa akun dan tanpa batas menit: perangkat Anda yang bekerja, jadi tidak ada yang perlu dihitung. Rekaman yang sangat panjang hanya dibatasi oleh memori perangkat Anda.