ПочатиПочніть безкоштовно

Від AudioFile до AudioData

Як ви вже бачили, щоб аудіодані були корисними, потрібно виконати кілька кроків перетворення. Те саме стосується і SpeechRecognition.

У цій вправі ми імпортуємо аудіофайл clean_support_call.wav і підготуємо його до розпізнавання.

Спершу ми зчитаємо аудіофайл за допомогою класу AudioFile. Але метод recognize_google() вимагає вхідних даних типу AudioData.

Щоб перетворити наш AudioFile на AudioData, скористаємося методом record() класу Recognizer разом із менеджером контексту. Метод record() приймає AudioFile як вхідні дані й перетворює його на AudioData, готові до використання з recognize_google().

SpeechRecognition уже імпортовано як sr.

Ця вправа є частиною курсу

Обробка усного мовлення в Python

Переглянути курс

Інструкції до вправи

  • Передайте класу AudioFile файл clean_support_call.wav.
  • Скористайтеся менеджером контексту, щоб відкрити та зчитати clean_support_call як source.
  • Запишіть source і запустіть код.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
Редагувати та запускати код