メインコンテンツまでスキップ

AI音声認識に話者ラベル・音声イベント・句読点の設定が追加

· 約3分

QuantumSubtitleの音声認識は、音声や動画の会話をタイムスタンプ付きの字幕テキストに変換します。新しい認識オプションでは、各字幕の話者、会話以外の音を含めるか、句読点を表示するかを選べます。

音声認識に追加された設定​

認識タスクを作成するときに、次のオプションを必要に応じて設定できます。

  • **話者識別:**異なる声を区別し、字幕行に話者ラベルを付けます。認識後、字幕エディターでラベル名を変更できます。
  • **音声イベント:**笑い声、拍手、背景音などの非音声イベントを文字起こしに含めます。字幕ビューアーでイベント行を絞り込んだり、編集したりできます。
  • **句読点の制御:**字幕テキストに句読点を表示するか選択できます。この設定はテキストのコピーやエクスポートにも適用されます。

話者識別は声を区別してラベルを付ける機能で、話者の実名を特定するものではありません。文字起こしを確認した後、必要に応じてラベル名を変更してください。

オプションの使い方​

  1. 音声認識を開き、音声または動画ファイルをアップロードします。
  2. 音声の言語を選択します。不明な場合は「自動」のままにできます。
  3. 必要に応じて話者識別や音声イベントを有効にし、句読点を含めるか選択します。
  4. 認識を開始し、字幕エディターでタイムスタンプ付きの文字起こしを確認します。
  5. テキストを修正して話者名を変更し、SRTのダウンロードやテキストのコピー前にイベント行を絞り込むか編集します。

複数人が話すインタビュー、ポッドキャスト、講義、ウェビナーなど、話者を区別したいコンテンツや、会話以外の重要な音も伝えたい場合に便利です。人名や重なった会話、認識ミスを確認するため、音声を聞き直して校正してください。

よくある質問​

話者識別(ダイアライゼーション)とは何ですか?​

録音内の声を区別し、該当する字幕行にラベルを付ける機能です。エディターでラベル名を変更できます。

どのような音声イベントを検出できますか?​

笑い声、拍手、背景音などの非音声イベントを結果に含め、字幕ビューアーで絞り込みや編集ができます。

字幕から句読点を取り除けますか?​

はい。句読点の表示をオンまたはオフにできます。選択内容は字幕テキストのコピーやエクスポートに反映されます。

文字起こしをSRTで出力できますか?​

はい。内容を確認してからSRT字幕ファイルをダウンロードできます。

AI音声認識を試す、音声認識ガイド、または音声認識機能の紹介をご覧ください。