Transkripsi audio ke teks, gratis dan privat

MP3, M4A, WAV, OGG, Opus, atau video: pengenalan ucapan menuliskannya di browser Anda. Tanpa unggah, tanpa batas menit, sekitar seratus bahasa.

🔒 Pengenalan ucapan berjalan di browser Anda. Diunduh hanya sekali; rekaman Anda tidak dikirim ke mana pun.

Transkripsi pesan suara tanpa meninggalkan WhatsApp

Instal AnyFileFormat sebagai aplikasi dan aplikasi ini akan muncul di menu Bagikan ponsel Anda. Pesan suara ditranskripsi di perangkat Anda dan tidak dikirim ke mana pun.

  1. Instal aplikasi (sekali saja).
  2. Di WhatsApp atau Telegram, tekan lama pesan suara, lalu ketuk Bagikan.
  3. Pilih AnyFileFormat: transkripsi dimulai dengan sendirinya.

Panduan

  1. Letakkan file audio atau video.
  2. Biarkan deteksi bahasa otomatis dan pilih mode: Fast, Balanced, atau Accurate.
  3. Transkripsi, perbaiki kata mana pun langsung di tempat, lalu salin teksnya atau unduh TXT, SRT, atau VTT.

Letakkan rekaman audio di atas dan Anda mendapatkan teksnya dalam beberapa detik hingga beberapa menit. Pengenalan ucapan berjalan di browser Anda: audio tidak pernah diunggah, tanpa batas durasi, dan tanpa akun.

Yang Anda dapatkan

  • Ini pengenalan ucapan, bukan perubahan format: alat ini mendengarkan rekaman dan menuliskan apa yang diucapkan, lengkap dengan tanda baca dan huruf kapital.
  • Teks dibagi menjadi paragraf pada setiap jeda. Stempel waktu tetap ditampilkan di layar, serta dalam ekspor SRT dan VTT.
  • Sekitar seratus bahasa, terdeteksi secara otomatis. Ucapan juga bisa diterjemahkan ke bahasa Inggris.
  • Ucapan yang jelas menghasilkan teks yang nyaris sempurna. Kebisingan latar, orang yang berbicara bersamaan, dan nama yang jarang dapat menimbulkan kesalahan, yang bisa Anda perbaiki langsung sebelum mengunduh.
  • Pembicara tidak diberi label: teks menunjukkan apa yang dikatakan, bukan siapa yang mengatakannya.

Kegunaannya

Gunakan teks biasa untuk catatan, notula, kutipan wawancara, pesan suara yang tidak bisa Anda dengarkan saat ini, atau apa pun yang ingin Anda cari, salin, atau terjemahkan.

Karena tidak ada yang diunggah, alat ini cocok untuk rekaman rahasia: wawancara medis, hukum, SDM, atau catatan suara pribadi.

Pertanyaan umum

Apakah file audio saya diunggah?

Tidak. Pengenalan ucapan diunduh ke browser Anda sekali dan dijalankan di sana. Rekamannya sendiri tidak pernah meninggalkan perangkat Anda: setelah dimuat, Anda bisa memutus koneksi internet dan semuanya tetap berfungsi.

Seberapa akurat hasilnya?

Pada suara yang jelas, Accurate hanya membuat sedikit kesalahan; Fast membuat lebih banyak kesalahan tetapi berjalan di ponsel apa pun, dan Balanced berada di antaranya. Setiap baris bisa diperbaiki sebelum Anda mengunduh.

Berapa lama prosesnya?

Di komputer yang cukup baru, satu menit ucapan butuh beberapa detik dengan Fast atau Accurate, dan sedikit lebih lama dengan Balanced. Ponsel lebih lambat. Bagian hening dilewati, jadi rekaman panjang dengan banyak jeda diproses lebih cepat daripada durasinya.

Mengapa ada unduhan saat pertama kali?

Mengenali ucapan di perangkat Anda berarti mengunduh komponen pengenalannya: 80 MB untuk Fast, 245 MB untuk Balanced, 545 MB untuk Accurate. Komponen ini disimpan di browser Anda, sehingga transkripsi berikutnya langsung dimulai.

Bahasa apa saja yang didukung?

Sekitar seratus bahasa, termasuk Inggris, Prancis, Spanyol, Jerman, Italia, Portugis, Belanda, Arab, Tionghoa, Jepang, dan Rusia. Bahasa terdeteksi secara otomatis; Anda juga bisa memilihnya sendiri.

Apakah gratis? Apakah ada batas durasi?

Gratis, tanpa akun dan tanpa batas menit: perangkat Anda yang bekerja, jadi tidak ada yang perlu dihitung. Rekaman yang sangat panjang hanya dibatasi oleh memori perangkat Anda.