AI 語音辨識新增說話者辨識、聲音事件與標點控制
· 閱讀時間約 3 分鐘
QuantumSubtitle 語音辨識可將音訊和影片中的語音轉換成附有時間碼的字幕文字。新增的辨識選項讓您進一步控制每句字幕對應的說話者、是否包含非語音聲音,以及字幕是否保留標點。
語音辨識新增了哪些控制選項?
建立辨識工作時,您可以視需要設定以下選項:
- **說話者辨識:**區分不同聲音,並為對應的字幕片段加上說話者標籤。辨識完成後可在字幕編輯器中重新命名標籤。
- **聲音事件:**將笑聲、掌聲和背景聲音等非語音事件加入轉錄結果。您可以在字幕檢視器中篩選或編輯事件字幕。
- **標點控制:**選擇字幕文字是否顯示標點符號;此設定會套用至複製或匯出的文字。
說話者辨識的用途是區分聲音並加上標籤,不會自動判斷說話者的真實姓名。檢查轉錄結果後,您可以自行重新命名標籤。
如何使用這些選項
- 開啟語音辨識,上傳音訊或影片檔案。
- 選擇音訊語言;如果不確定,可保留「自動」設定。
- 視需要開啟說話者辨識或聲音事件偵測,並選擇是否保留標點。
- 開始辨識,接著在字幕編輯器中檢查附有時間碼的轉錄結果。
- 校正文字、重新命名說話者,並在下載 SRT 檔案或複製文字前篩選或編輯事件字幕。
這些選項適用於訪談、Podcast、課程、線上研討會等情境,尤其適合需要區分多位說話者,或呈現對白以外重要聲音的內容。清晰的錄音和人工校對仍有助於修正人名、重疊語音及辨識錯誤。
常見問題
什麼是說話者辨識或說話者分離?
說話者分離會區分錄音中的不同聲音,並為對應的字幕片段指派標籤。您可以在編輯器中重新命名這些標籤。
可以偵測哪些聲音事件?
您可以將笑聲、掌聲和背景聲音等非語音事件加入結果,並在字幕檢視器中篩選或編輯。
可以移除字幕中的標點嗎?
可以。您可以開啟或關閉標點顯示;複製或匯出字幕文字時會套用此設定。
可以將轉錄結果匯出為 SRT 嗎?
可以。檢查轉錄結果後,即可下載 SRT 字幕檔案。
