НачатьНачать бесплатно

От AudioFile к AudioData

Как вы уже видели, прежде чем использовать аудиоданные, их необходимо преобразовать. То же самое касается и библиотеки SpeechRecognition.

В этом упражнении мы импортируем аудиофайл clean_support_call.wav и подготовим его к распознаванию.

Сначала мы читаем аудиофайл с помощью класса AudioFile. Однако метод recognize_google() ожидает на входе объект типа AudioData.

Чтобы преобразовать AudioFile в AudioData, воспользуемся методом record() класса Recognizer совместно с контекстным менеджером. Метод record() принимает AudioFile и преобразует его в AudioData, готовый к использованию с recognize_google().

Библиотека SpeechRecognition уже импортирована как sr.

Это упражнение является частью курса

Обработка устной речи на Python

Посмотреть курс

Инструкции к упражнению

  • Передайте классу AudioFile файл clean_support_call.wav.
  • Используйте контекстный менеджер, чтобы открыть и прочитать clean_support_call как source.
  • Запишите source и запустите код.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
Редактировать и запускать код