НачатьНачать бесплатно

Несколько говорящих 1

Если ваша цель — транскрибировать диалоги, в них будет участвовать более одного говорящего. Однако, как вы сейчас увидите, функция recognize_google() преобразует речь в единый блок текста.

В этом аудиофайле можно услышать трёх разных говорящих.

Однако при самостоятельной транскрибации recognize_google() возвращает единый блок текста. Это по-прежнему полезно, но не позволяет определить, кто именно что сказал.

В следующем упражнении мы рассмотрим альтернативный подход.

Аудиофайл с несколькими говорящими уже импортирован и преобразован в AudioData под именем multiple_speakers.

Это упражнение является частью курса

Обработка устной речи на Python

Посмотреть курс

Инструкции к упражнению

  • Создайте экземпляр Recognizer.
  • Распознайте переменную multiple_speakers с помощью функции recognize_google().
  • Установите язык — американский английский ("en-US").

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Create a recognizer class
recognizer = sr.____()

# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____, 
                       			   language=____)

# Print the text
print(text)
Редактировать и запускать код