音声を文字起こし
録音、ボイスメモ、ポッドキャスト、動画をインポートすると、AI「Whisper」がタイムスタンプ付きでテキスト化します。すべてブラウザ内で完結、無料でファイル送信もありません。
- AI Whisper
- 約100言語対応
- TXT・SRT出力
- 100% プライベート
100% プライベート — すべてブラウザ内で直接処理されます。ファイル、音声、映像がChatzamのサーバーに送信されることはありません。
音声ファイルを文字起こしする方法は?
-
ファイルをインポート
MP3、WAV、M4A、OGG、またはMP4・MOV・WebMなどの動画をエリアにドラッグします。
-
言語を選択
話されている言語(または自動検出)と、希望する精度を選びます。
-
テキストを取得
文字起こし結果をコピーするか、字幕用にTXTまたはSRT形式でダウンロードします。
プライバシーを妥協しないAI文字起こし
OpenAIのWhisperエンジン
多くの有料ツールと同じ音声認識モデルを、ブラウザ内で実行します。
音声と動画に対応
一般的な形式をすべて受け付け、動画の音声トラックも自動抽出されます。
タイムスタンプと字幕
分単位のタイムスタンプ付きでテキストを表示するか、YouTubeや編集ソフト用のSRTファイルを出力できます。
ファイル送信なし
会議、面談、ボイスメモの録音は端末の外に出ることはありません。
AIで音声を文字起こし
会議、インタビュー、講義、ボイスメッセージ、ポッドキャストなど、手作業での文字起こしは何時間もかかります。このツールはOpenAIの音声認識モデル「Whisper」を使い、音声を書き起こしたテキストに変換します。最高品質を求めるなら「精密」、非力なパソコンで長いファイルを扱うなら「高速」を選んでください。
無料でプライベートな文字起こし:仕組みは?
初回利用時にAIモデル(約40〜80MB)が一度だけダウンロードされ、以降はブラウザにキャッシュされます。文字起こしはその後、端末上で完全に実行されます。ファイルがアップロードされることはありません。処理時間はパソコンの性能と音声の長さによって変わります。
ワンクリックでSRT字幕を作成
テキストはタイムスタンプ付きのセグメントに分割されます。YouTube、TikTok、Instagramの動画に字幕を追加したり、編集ソフトで調整したりするためにSRT形式でエクスポートできます。
よくある質問
音声の文字起こしは本当に無料ですか?
はい。AIモデルは端末上で実行されるため、サブスクリプションも長さの制限もありません。
どの言語に対応していますか?
Whisperは約100言語を認識します。フランス語、英語、スペイン語、ドイツ語、イタリア語、ポルトガル語、オランダ語で最も高い精度が得られます。
文字起こしにはどれくらい時間がかかりますか?
パソコンの性能と選んだモードによって異なります。「高速」モードは大幅に速く、「精密」モードは時間がかかりますがより信頼性が高いです。処理中はタブを開いたままにしてください。
ファイルはサーバーに送信されますか?
いいえ。ダウンロードされるのはHugging FaceからのAIモデルのみで、音声は最初から最後まで端末に残ります。