メインコンテンツまでスキップ

クイックスタートビデオ

クイックデモをご覧いただき、以下の手順に従ってください。

音声認識 - ビデオ/オーディオからの字幕自動生成

高度なAI音声認識技術を使用して、ビデオおよびオーディオファイルを正確な字幕ファイルに変換します。この強力な機能は、話されたコンテンツを自動的にテキストに変換し、プロフェッショナルなSRT字幕ファイルを作成します。

音声認識とは?​

当社の音声認識機能は、最先端のAI技術を使用して、ビデオおよびオーディオファイルからのオーディオコンテンツを自動的に文字起こしします。複数の言語を自動的に検出し、翻訳または直接使用できる正確な字幕ファイルを生成できます。

主な機能:

  • 自動言語検出: 話された言語をインテリジェントに識別します
  • 高精度: 高度なAIモデルにより正確な文字起こしを保証します
  • 複数フォーマット対応: さまざまなビデオおよびオーディオフォーマットに対応します
  • SRT出力: ユニバーサルな互換性のために標準的なSRT字幕ファイルを生成します

ステップバイステップガイド​

ビデオまたはオーディオファイルから字幕を生成するには、以下の簡単な手順に従ってください。

  1. ファイルをアップロード: デバイスからビデオまたはオーディオファイルを選択します。サポートされているフォーマットには、MP4、AVI、MOV、MP3、WAVなどがあります。

  2. 言語を選択: 話されたコンテンツの言語を選択します。最良の結果を得るには、「自動検出」を選択して、AIに言語を自動的に識別させます。

  3. 認識を開始: 「認識」ボタンをクリックして、音声認識プロセスを開始します。AIがオーディオコンテンツを分析し、テキストに変換します。

  4. 結果をダウンロード: 処理が完了したら、生成されたSRT字幕ファイルをダウンロードします。ファイルは、使用またはさらなる翻訳の準備ができています。

最良の結果を得るためのヒント​

  • クリアなオーディオ品質: ビデオ/オーディオに背景ノイズのないクリアな音声があることを確認してください
  • 単一言語: 最適な精度を得るために、1つの主要な言語のコンテンツを使用してください
  • 適切な音量: 音声の音量が認識に十分であることを確認してください
  • ファイルサイズ: 大きなファイルは処理に時間がかかる場合がありますが、効果的に機能します

話者ラベルと字幕を確認する​

話者認識を有効にすると、エディターは認識した話者ごとに音声セグメントを整理します。話者名を変更したり、字幕のテキストを修正したり、行に別の話者を割り当てたりできます。字幕や音声イベントが割り当てられている話者は削除できません。編集内容は自動保存され、保存に失敗した場合は再試行できます。

SRTの各字幕キューには時間範囲が残ります。話者認識を使った場合、話者名は字幕テキストに含まれます。音声イベントも有効にすると、認識されたイベントが字幕キューとして出力されることがあります。公開前に名前、重なった発話、イベント名を確認してください。

音声認識ツールでタスクを作成できます。校正後はオンラインSRT翻訳ツールも利用できます。