От AudioFile к AudioData
Как вы уже видели, прежде чем использовать аудиоданные, их необходимо преобразовать. То же самое касается и библиотеки SpeechRecognition.
В этом упражнении мы импортируем аудиофайл clean_support_call.wav и подготовим его к распознаванию.
Сначала мы читаем аудиофайл с помощью класса AudioFile. Однако метод recognize_google() ожидает на входе объект типа AudioData.
Чтобы преобразовать AudioFile в AudioData, воспользуемся методом record() класса Recognizer совместно с контекстным менеджером. Метод record() принимает AudioFile и преобразует его в AudioData, готовый к использованию с recognize_google().
Библиотека SpeechRecognition уже импортирована как sr.
Это упражнение является частью курса
Обработка устной речи на Python
Инструкции к упражнению
- Передайте классу
AudioFileфайлclean_support_call.wav. - Используйте контекстный менеджер, чтобы открыть и прочитать
clean_support_callкакsource. - Запишите
sourceи запустите код.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Instantiate Recognizer
recognizer = sr.Recognizer()
# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)
# Convert AudioFile to AudioData
with ____ as source:
clean_support_call_audio = recognizer.record(____)
# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
language="en-US")
print(text)