音声をテキストに文字起こし、無料・プライバシー保護

MP3、M4A、WAV、OGG、Opus、動画:ブラウザ内の音声認識で文字に起こします。アップロードなし、時間制限なし、約 100 言語に対応。

🔒 音声認識はブラウザ内で動作します。ダウンロードは一度だけで、録音はどこにも送信されません。

WhatsApp から離れずにボイスメッセージを文字起こし

AnyFileFormat をアプリとしてインストールすると、スマートフォンの共有メニューに表示されます。ボイスメッセージはデバイス上で文字起こしされ、どこにも送信されません。

  1. アプリをインストールします(初回のみ)。
  2. WhatsApp または Telegram で、ボイスメッセージを長押しして「共有」をタップします。
  3. AnyFileFormat を選ぶと、文字起こしが自動的に始まります。

使い方

  1. 音声または動画ファイルをドロップします。
  2. 言語は自動検出のまま、モードを選びます:Fast、Balanced、Accurate。
  3. 文字起こしして単語をその場で修正し、テキストをコピーするか TXT、SRT、VTT でダウンロードします。

上に 音声 の録音をドロップすると、数秒から数分でテキストになります。音声認識はブラウザ内で動作するため、音声がアップロードされることはなく、長さの制限もアカウントも不要です。

得られるもの

  • これは形式の変換ではなく音声認識です。録音を聞き取り、話された内容を句読点付きで書き起こします。
  • テキストは間の部分で段落に分けられます。タイムスタンプは画面上に表示され、SRT と VTT の書き出しにも含まれます。
  • 約 100 言語を自動で検出します。音声を英語に翻訳することもできます。
  • はっきりした話し声ならほぼ完璧に書き起こせます。背景の雑音、複数人の同時発話、珍しい固有名詞は誤りの原因になりますが、ダウンロード前にその場で修正できます。
  • 話者は区別されません。テキストには誰が話したかではなく、何が話されたかが記録されます。

用途

メモ、議事録、インタビューの引用、今は聞けないボイスメッセージなど、検索・コピー・翻訳したいものにはプレーンテキストが便利です。

何もアップロードされないため、医療、法律、人事面接などの機密性の高い録音や、個人的なボイスメモにも安心して使えます。

よくある質問

音声 ファイルはアップロードされますか?

いいえ。音声認識は一度だけブラウザにダウンロードされ、そこで動作します。録音そのものがデバイスから出ることはありません。読み込み後はオフラインにしても動作します。

精度はどのくらいですか?

はっきりした声なら、Accurate はほとんど間違えません。Fast は間違いが多めですがどのスマートフォンでも動作し、Balanced はその中間です。ダウンロード前にすべての行を修正できます。

どのくらい時間がかかりますか?

最近のパソコンなら、1 分間の音声は Fast や Accurate で数秒、Balanced ではもう少しかかります。スマートフォンではより時間がかかります。無音部分はスキップされるため、間の多い長い録音は長さの割に早く終わります。

初回にダウンロードがあるのはなぜですか?

デバイス上で音声認識を行うには、認識機能自体をダウンロードする必要があります:Fast は 80 MB、Balanced は 245 MB、Accurate は 545 MB です。ブラウザに保存されるため、次回以降の文字起こしはすぐに始まります。

どの言語に対応していますか?

英語、フランス語、スペイン語、ドイツ語、イタリア語、ポルトガル語、オランダ語、アラビア語、中国語、日本語、ロシア語など、約 100 言語に対応しています。言語は自動で検出されますが、手動で指定することもできます。

無料ですか? 長さの制限はありますか?

無料でアカウント不要、時間の制限もありません。処理はお使いのデバイスで行われるため、計測するものがないのです。非常に長い録音でも、制限となるのはデバイスのメモリだけです。