본문으로 건너뛰기

AI 음성 인식에 화자 라벨, 오디오 이벤트, 문장 부호 제어 추가

· 약 2분

QuantumSubtitle 음성 인식은 오디오와 비디오의 음성을 타임스탬프가 포함된 자막 텍스트로 변환합니다. 새 인식 옵션을 사용하면 각 자막의 화자, 대화 외 소리의 포함 여부, 문장 부호 표시 여부를 선택할 수 있습니다.

새 음성 인식 설정​

인식 작업을 만들 때 다음 옵션을 필요에 따라 설정할 수 있습니다.

  • 화자 인식: 서로 다른 목소리를 구분하고 해당 자막 구간에 화자 라벨을 붙입니다. 인식 후 자막 편집기에서 라벨 이름을 바꿀 수 있습니다.
  • 오디오 이벤트: 웃음, 박수, 배경음과 같은 비음성 이벤트를 인식 결과에 포함합니다. 자막 뷰어에서 이벤트 자막을 필터링하거나 편집할 수 있습니다.
  • 문장 부호 제어: 자막 텍스트에 문장 부호를 표시할지 선택합니다. 이 설정은 텍스트 복사와 내보내기에 적용됩니다.

화자 인식은 목소리를 구분하고 라벨을 지정하는 기능이며, 실제 화자의 이름을 자동으로 알아내지는 않습니다. 결과를 확인한 뒤 라벨 이름을 직접 바꾸세요.

옵션 사용 방법​

  1. 음성 인식을 열고 오디오 또는 비디오 파일을 업로드합니다.
  2. 오디오 언어를 선택합니다. 확실하지 않으면 자동 감지를 그대로 사용할 수 있습니다.
  3. 필요에 따라 화자 인식이나 오디오 이벤트를 켜고 문장 부호 포함 여부를 선택합니다.
  4. 인식을 시작한 다음 자막 편집기에서 타임스탬프가 포함된 내용을 검토합니다.
  5. 텍스트를 수정하고 화자 이름을 바꾼 뒤 SRT를 다운로드하거나 텍스트를 복사하기 전에 이벤트 자막을 필터링하거나 편집합니다.

인터뷰, 팟캐스트, 강의, 웨비나처럼 여러 화자를 구분해야 하거나 대화 외의 중요한 소리도 전달해야 하는 녹음에 유용합니다. 이름, 겹치는 발화, 인식 오류를 잡으려면 음성을 다시 듣고 검토하는 것이 좋습니다.

자주 묻는 질문​

화자 인식 또는 화자 분리란 무엇인가요?​

녹음에서 서로 다른 목소리를 구분해 해당 자막 구간에 라벨을 지정합니다. 편집기에서 라벨 이름을 바꿀 수 있습니다.

어떤 오디오 이벤트를 감지하나요?​

웃음, 박수, 배경음 등의 비음성 이벤트를 결과에 포함할 수 있으며 자막 뷰어에서 필터링하거나 편집할 수 있습니다.

자막에서 문장 부호를 제거할 수 있나요?​

네. 문장 부호 표시를 켜거나 끌 수 있습니다. 선택한 설정은 자막 텍스트 복사와 내보내기에 반영됩니다.

인식 결과를 SRT로 내보낼 수 있나요?​

네. 결과를 검토한 뒤 SRT 자막 파일을 다운로드할 수 있습니다.

AI 음성 인식 사용하기, 음성 인식 가이드, 음성 인식 기능 소개를 확인해 보세요.