講者身分辨識
AI 語音辨識技術能偵測並標記不同講者,讓訪談與會議記錄清晰易讀。
上傳任何音訊或影片檔案,貼上 YouTube、Vimeo 或 Instagram 連結,或直接用麥克風錄音。AI 會以高準確度把語音轉成文字,自動辨識講者身分,並一鍵翻譯成 100+ 種語言。

亮點功能
AI 語音辨識技術能偵測並標記不同講者,讓訪談與會議記錄清晰易讀。
貼上 YouTube、Vimeo 或 Instagram 連結,或從 Google Drive、Dropbox 或 OneDrive 拉取檔案——不需要手動下載。
開啟自動翻譯功能,即可在取得原文逐字稿的同時,取得目標語言版本。
運作方式
上傳最大 2GB 的檔案,貼上串流網址,或直接在瀏覽器中錄音。
語音會被分段、加上時間戳記並依講者標記,並可套用選擇性的翻譯。
下載為 SRT、VTT、TXT、PDF、DOCX 或 CSV 格式——可選擇是否包含時間戳記。
功能
常見用途
常見問題
支援 MP3、MP4、WAV、M4A、FLAC、OGG、WebM、MOV 與 AVI,每個檔案最大 2GB。
可以。直接貼上 YouTube、Vimeo 或 Instagram 網址,工具就會擷取並轉錄音訊,不需要手動下載步驟。
逐字稿可匯出為 SRT、VTT、TXT、PDF、DOCX 或 CSV 格式,可選擇是否包含時間戳記。你也可以在匯出前,把逐字稿自動翻譯成 100+ 種語言。
可以。自動講者辨識功能會標記出誰在說話,這對訪談、座談與會議記錄很有幫助。
每分鐘音訊需要 6 點數。確認工作前會顯示所需點數。