すべてのツール

動画を文字起こし

動画の音声を Whisper で文字と字幕(SRT/VTT)に書き起こします — ブラウザ内で処理、アップロードなし。

オーディオまたは動画ファイルを選択

MP3・WAV・M4A・MP4・MOV・WebM — Whisper でブラウザ内で文字起こし

クリックして選択するか、ファイルをここにドロップ

使い方: 動画を文字起こし

  1. 1

    動画を追加

    音声トラックのある MP4・MOV・WebM をドロップ — ブラウザ内で読み込まれ、アップロードはされません。

  2. 2

    モデルと言語を選択

    Base は高精度、Tiny は高速。言語は自動検出のままにするか設定します。モデルは一度ダウンロードされ(約 40 ~ 80 MB)、その後はキャッシュされます。

  3. 3

    文字起こししてエクスポート

    「文字起こし」をクリック。完了したら、書き起こしをプレーンテキストまたは SRT・VTT 字幕でコピーまたはダウンロードします。

Related PDF tools

動画を文字起こし — よくある質問

私の動画はアップロードされますか?+

いいえ。文字起こしモデル(OpenAI の Whisper)は WebAssembly を通じてすべてブラウザ内で動作します。動画がデバイスから出ることはありません。

なぜ 1 回だけダウンロードがあるのですか?+

Whisper のモデルの重み(Tiny は約 40 MB、Base は約 80 MB、量子化済み)は、そのサイズを初めて使うときにダウンロードされ、その後ブラウザがキャッシュします — 以降はオフラインで動作し、すぐに開始します。

どれくらい正確ですか?+

Base はサポート言語の明瞭な発話に対して安定しています。Tiny は明らかに粗いですがはるかに高速です。どちらも強い訛り、話し声の重なり、音楽のバック、低品質の音声には弱いので、出力は校正してください。

何をエクスポートできますか?+

プレーンテキスト、または SRT・VTT のタイミング付き字幕。SRT/VTT のタイミングはモデルのセグメントのタイムスタンプから得られます。

ファイルはサーバーにアップロードされますか?+

いいえ。ここにあるすべてのツールはファイルを完全にお使いの端末内で処理し、サーバーには何もアップロードされません。唯一の例外はAIツールで、作業のために抽出したテキスト(ファイルそのものではありません)をClaudeに送信します。

ファイルサイズの制限はありますか?+

当サイトが設ける人為的な制限はありませんが、処理はブラウザ内で行われるため、非常に大きなファイル(500MB以上、1,000ページ以上など)はお使いの端末のメモリによって制限されます。