字幕の各行にタイムスタンプ
認識した各行を、開始時刻と終了時刻とともに確認できます。
録音や動画の音声をタイムスタンプ付きの字幕に変換し、SRTまたはJSONでダウンロードできます。
最長3時間・1ファイル最大2 GB
MP4/FLV/TS/AVI/MOV/WMV/MKV/MP3/M4A/WAV
アカウントで保護され、クラウドで処理されます。元動画:24時間 · 処理結果:7日間
インタビュー、会議、動画の字幕の下書きを作成できます。タイムスタンプから、それぞれの発言箇所を探しやすくなります。
認識した各行を、開始時刻と終了時刻とともに確認できます。
文字起こしする言語は、中国語(簡体字)、英語(米国)、スペイン語、インドネシア語から選べます。
送信後は、ほかのページを使っている間もタスクが進みます。
字幕エディターやプレーヤーで使うならSRT、テキスト・時刻・利用可能な話者ラベルを構造化して使うならJSONを選べます。
確認済みの入力時間に基づいて見積もり、開始前に合計を表示します。
アカウントから元ファイルは24時間、文字起こし結果は7日間利用できます。
アップロードし、音声の言語を選んで、文字起こし結果をダウンロード。
2 GB以下、3時間以内の対応する音声・動画を選択します。
音声の言語と、話者ラベルを付けるかどうかを選択します。
タイムスタンプ付きの文字起こし結果を確認し、SRTまたはJSONでダウンロードします。
インタビュー、録音、動画編集に使う字幕ファイルを準備できます。
録音した会話からタイムスタンプ付きのテキストを作成し、内容の確認や編集に活用できます。

対応する録音を字幕に変換し、確認して書き出せます。

対応する動画ファイルから、SRTまたはJSON形式の文字起こし結果を生成できます。

ファイルはアップロード後に確認されます。元のファイルは保管してください。
1つの音声・動画ファイルにつき最大2 GB、最長3時間です。長い録音はアップロード前に分割してください。
録音の音声に合わせて、中国語(簡体字)、英語(米国)、スペイン語(スペイン)、インドネシア語から選んでください。
プレーヤーや編集ソフトで使うSRT字幕、またはテキストとタイムスタンプを構造化したJSONをダウンロードできます。字幕は別ファイルとして作成され、動画への焼き込みは行いません。普段お使いの字幕エディターで内容を確認・編集してください。
話者ラベルを有効にすると、声の区別を試みます。利用可能な場合はspeaker_0などのラベルが付きますが、実際の人物を特定するものではなく、欠落や誤りが生じる場合もあります。
雑音、発言の重なり、アクセント、不明瞭な発音によって、単語の欠落や誤認識が起こる場合があります。名前、数字、時刻を録音と照合し、ダウンロードしたファイルを字幕エディターやテキストエディターで修正してください。
対応言語、文字起こしの精度、ダウンロードしたファイルの使い方をご確認ください。