Перейти к основному содержимому

Распознавание речи с ИИ: метки говорящих, звуковые события и пунктуация

· 2 мин. чтения

Распознавание речи QuantumSubtitle преобразует речь из аудио и видео в текст субтитров с временными метками. Новые параметры позволяют указать, кто произносит каждую реплику, какие неречевые звуки включать в расшифровку и отображать ли знаки препинания.

Новые параметры распознавания речи​

При создании задачи можно настроить следующие параметры:

  • Распознавание говорящих: разделяет разные голоса и присваивает метки соответствующим фрагментам субтитров. После распознавания метки можно переименовать в редакторе.
  • Звуковые события: добавляет обнаруженные неречевые звуки, например смех, аплодисменты и фоновые звуки. Такие фрагменты можно фильтровать или редактировать в просмотрщике субтитров.
  • Управление пунктуацией: позволяет выбрать, отображать ли знаки препинания в тексте субтитров. Настройка применяется при копировании и экспорте текста.

Распознавание говорящих различает голоса и назначает им метки, но не определяет реальные имена людей. Просмотрите расшифровку и переименуйте метки вручную при необходимости.

Как использовать параметры​

  1. Откройте распознавание речи и загрузите аудио- или видеофайл.
  2. Выберите язык аудио или оставьте автоматическое определение, если не уверены.
  3. При необходимости включите распознавание говорящих и звуковые события, а также выберите, добавлять ли пунктуацию.
  4. Запустите распознавание и проверьте расшифровку с временными метками в редакторе субтитров.
  5. Исправьте текст, переименуйте говорящих, отфильтруйте или отредактируйте события и скачайте файл SRT либо скопируйте текст.

Эти параметры пригодятся для интервью, подкастов, лекций, вебинаров и других записей, где важно различать несколько голосов или передавать значимые звуки помимо речи. Хорошее качество аудио и проверка результата помогут исправить имена, наложение реплик и ошибки распознавания.

Часто задаваемые вопросы​

Что такое распознавание говорящих, или диаризация?​

Функция разделяет голоса в записи и присваивает метки соответствующим фрагментам субтитров. Метки можно переименовать в редакторе.

Какие звуковые события распознаются?​

В результат можно включить неречевые звуки, например смех, аплодисменты и фоновые звуки. Их можно фильтровать или редактировать в просмотрщике субтитров.

Можно ли убрать пунктуацию из субтитров?​

Да. Включите или отключите отображение пунктуации. Выбранная настройка применяется при копировании и экспорте текста.

Можно ли скачать расшифровку в формате SRT?​

Да. Проверьте результат и скачайте файл субтитров SRT.

Попробуйте распознавание речи с ИИ, прочитайте руководство по распознаванию речи или посетите страницу функции.