Несколько говорящих 1
Если ваша цель — транскрибировать диалоги, в них будет участвовать более одного говорящего. Однако, как вы сейчас увидите, функция recognize_google() преобразует речь в единый блок текста.
В этом аудиофайле можно услышать трёх разных говорящих.
Однако при самостоятельной транскрибации recognize_google() возвращает единый блок текста. Это по-прежнему полезно, но не позволяет определить, кто именно что сказал.
В следующем упражнении мы рассмотрим альтернативный подход.
Аудиофайл с несколькими говорящими уже импортирован и преобразован в AudioData под именем multiple_speakers.
Это упражнение является частью курса
Обработка устной речи на Python
Инструкции к упражнению
- Создайте экземпляр
Recognizer. - Распознайте переменную
multiple_speakersс помощью функцииrecognize_google(). - Установите язык — американский английский (
"en-US").
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)