跳至主要内容

AI 語音辨識新增說話者辨識、聲音事件與標點控制

· 閱讀時間約 3 分鐘

QuantumSubtitle 語音辨識可將音訊和影片中的語音轉換成附有時間碼的字幕文字。新增的辨識選項讓您進一步控制每句字幕對應的說話者、是否包含非語音聲音,以及字幕是否保留標點。

語音辨識新增了哪些控制選項?​

建立辨識工作時,您可以視需要設定以下選項:

  • **說話者辨識:**區分不同聲音,並為對應的字幕片段加上說話者標籤。辨識完成後可在字幕編輯器中重新命名標籤。
  • **聲音事件:**將笑聲、掌聲和背景聲音等非語音事件加入轉錄結果。您可以在字幕檢視器中篩選或編輯事件字幕。
  • **標點控制:**選擇字幕文字是否顯示標點符號;此設定會套用至複製或匯出的文字。

說話者辨識的用途是區分聲音並加上標籤,不會自動判斷說話者的真實姓名。檢查轉錄結果後,您可以自行重新命名標籤。

如何使用這些選項​

  1. 開啟語音辨識,上傳音訊或影片檔案。
  2. 選擇音訊語言;如果不確定,可保留「自動」設定。
  3. 視需要開啟說話者辨識或聲音事件偵測,並選擇是否保留標點。
  4. 開始辨識,接著在字幕編輯器中檢查附有時間碼的轉錄結果。
  5. 校正文字、重新命名說話者,並在下載 SRT 檔案或複製文字前篩選或編輯事件字幕。

這些選項適用於訪談、Podcast、課程、線上研討會等情境,尤其適合需要區分多位說話者,或呈現對白以外重要聲音的內容。清晰的錄音和人工校對仍有助於修正人名、重疊語音及辨識錯誤。

常見問題​

什麼是說話者辨識或說話者分離?​

說話者分離會區分錄音中的不同聲音,並為對應的字幕片段指派標籤。您可以在編輯器中重新命名這些標籤。

可以偵測哪些聲音事件?​

您可以將笑聲、掌聲和背景聲音等非語音事件加入結果,並在字幕檢視器中篩選或編輯。

可以移除字幕中的標點嗎?​

可以。您可以開啟或關閉標點顯示;複製或匯出字幕文字時會套用此設定。

可以將轉錄結果匯出為 SRT 嗎?​

可以。檢查轉錄結果後,即可下載 SRT 字幕檔案。

立即使用AI語音辨識,查看語音辨識教學,或前往語音辨識功能介紹。