Buat subtitle dari video secara otomatis

Masukan MP4, MOV, MKV, WebM; hasil teks SRT atau VTT dengan penanda waktu, siap untuk YouTube, Premiere, DaVinci Resolve, atau pemutar video. Dibuat di perangkat Anda.

🔒 Pengenalan ucapan berjalan di browser Anda. Diunduh hanya sekali; rekaman Anda tidak dikirim ke mana pun.

Panduan

  1. Letakkan video.
  2. Biarkan deteksi bahasa otomatis, atau pilih "Diterjemahkan ke bahasa Inggris" untuk subtitle berbahasa Inggris.
  3. Transkripsi, perbaiki baris mana pun sambil menonton, lalu unduh SRT atau VTT.

Letakkan video MP4, MOV, WebM di atas dan Anda mendapatkan subtitle SRT dengan penanda waktu dalam beberapa detik hingga beberapa menit. Pengenalan ucapan berjalan di browser Anda: video tidak pernah diunggah, tanpa batas durasi, dan tanpa akun.

Yang Anda dapatkan

  • Ini pengenalan ucapan, bukan perubahan format: alat ini mendengarkan suara video dan menuliskan apa yang diucapkan, lengkap dengan tanda baca dan huruf kapital.
  • Setiap cue SRT diselaraskan dengan ucapan dan tetap mudah dibaca: maksimal dua baris sekitar 42 karakter, seperti standar subtitle penyiar televisi.
  • Sekitar seratus bahasa, terdeteksi secara otomatis. Ucapan juga bisa diterjemahkan ke bahasa Inggris.
  • Ucapan yang jelas menghasilkan teks yang nyaris sempurna. Kebisingan latar, orang yang berbicara bersamaan, dan nama yang jarang dapat menimbulkan kesalahan, yang bisa Anda perbaiki langsung sebelum mengunduh.
  • Pembicara tidak diberi label: teks menunjukkan apa yang dikatakan, bukan siapa yang mengatakannya.

Kegunaannya

Gunakan SRT untuk menambahkan teks ke video: subtitle untuk pemutar video apa pun. Teks membuat video bisa ditonton tanpa suara, cara kebanyakan orang menggulir, dan memberi mesin pencari kata-kata yang diucapkan di dalamnya.

Karena tidak ada yang diunggah, alat ini cocok untuk rekaman rahasia: wawancara medis, hukum, SDM, atau catatan suara pribadi.

Pertanyaan umum

Apakah file MP4, MOV, WebM saya diunggah?

Tidak. Pengenalan ucapan diunduh ke browser Anda sekali dan dijalankan di sana. Rekamannya sendiri tidak pernah meninggalkan perangkat Anda: setelah dimuat, Anda bisa memutus koneksi internet dan semuanya tetap berfungsi.

Seberapa akurat hasilnya?

Pada suara yang jelas, Accurate hanya membuat sedikit kesalahan; Fast membuat lebih banyak kesalahan tetapi berjalan di ponsel apa pun, dan Balanced berada di antaranya. Setiap baris bisa diperbaiki sebelum Anda mengunduh.

Berapa lama prosesnya?

Di komputer yang cukup baru, satu menit ucapan butuh beberapa detik dengan Fast atau Accurate, dan sedikit lebih lama dengan Balanced. Ponsel lebih lambat. Bagian hening dilewati, jadi rekaman panjang dengan banyak jeda diproses lebih cepat daripada durasinya.

Mengapa ada unduhan saat pertama kali?

Mengenali ucapan di perangkat Anda berarti mengunduh komponen pengenalannya: 80 MB untuk Fast, 245 MB untuk Balanced, 545 MB untuk Accurate. Komponen ini disimpan di browser Anda, sehingga transkripsi berikutnya langsung dimulai.

Bahasa apa saja yang didukung?

Sekitar seratus bahasa, termasuk Inggris, Prancis, Spanyol, Jerman, Italia, Portugis, Belanda, Arab, Tionghoa, Jepang, dan Rusia. Bahasa terdeteksi secara otomatis; Anda juga bisa memilihnya sendiri.

Apakah gratis? Apakah ada batas durasi?

Gratis, tanpa akun dan tanpa batas menit: perangkat Anda yang bekerja, jadi tidak ada yang perlu dihitung. Rekaman yang sangat panjang hanya dibatasi oleh memori perangkat Anda.