每條字幕都帶有時間標記
檢視辨識文字對應的起止時間。
將錄音和影片中的語音轉換為帶時間標記的字幕,可下載 SRT 或 JSON。
最長 3 小時;媒體檔案最大 2 GB
MP4 / FLV / TS / AVI / MOV / WMV / MKV / MP3 / M4A / WAV
檔案受帳戶權限保護,於雲端處理。原始檔案保留 24 小時,結果保留 7 天。
為訪談、會議和影片生成字幕初稿,透過時間標記快速定位每段語音。
檢視辨識文字對應的起止時間。
可選擇簡體中文、美國英語、西班牙語或印尼語。
提交任務後可繼續使用其他頁面,任務會在雲端處理。
SRT 可用於字幕編輯器和播放器;JSON 保留結構化文字、時間及可用的說話者標籤。
按檢查後的輸入長度報價,開始處理前顯示總積分。
原始檔案可在帳戶內存取 24 小時,轉錄結果可存取 7 天。
上傳檔案、選擇語音語言,然後下載轉錄結果。
選擇支援的音訊或影片,最大 2 GB、最長 3 小時。
選擇語音語言,並決定是否請求說話者標籤。
檢查帶時間標記的文字,然後下載 SRT 或 JSON。
為訪談、錄音和影片工作流程準備字幕檔案。
從錄製對話生成帶時間標記的文字,方便檢查和編輯。

將支援的錄音轉換為可檢視和匯出的字幕文字。

從支援的影片檔案生成 SRT 或 JSON 轉錄結果。

上傳後會檢查檔案是否符合要求,請保留原始檔案。
單個音訊或影片最大 2 GB、最長 3 小時,更長錄音需先拆分再上傳。
根據錄音中的語音選擇簡體中文、美國英語、西班牙語(西班牙)或印尼語。
可下載供播放器或編輯器使用的 SRT 字幕,或包含結構化文字和時間標記的 JSON。結果是獨立檔案,不會燒錄到影片畫面中;可在常用字幕編輯器中校對和修改。
開啟後會嘗試區分不同聲音,並在可用時返回 speaker_0 等標籤。標籤不代表真實身分,也可能缺失或辨識錯誤。
背景雜訊、多人同時說話、口音和含糊語音可能造成漏字或錯字。請對照錄音檢查人名、數字與時間,再用字幕或文字編輯器修改下載的檔案。
瞭解語言選擇、轉錄準確度與下載結果的用途。