Zacznij terazZacznij za darmo

Od AudioFile do AudioData

Jak już widziałeś(-aś) wcześniej, dane audio wymagają kilku kroków przekształcenia, zanim będzie można je efektywnie wykorzystać. Podobnie jest w przypadku biblioteki SpeechRecognition.

W tym ćwiczeniu zaimportujesz plik audio clean_support_call.wav (pobierz tutaj) i przygotowujesz go do rozpoznawania mowy.

Plik audio wczytujemy za pomocą klasy AudioFile. Jednak metoda recognize_google() wymaga danych w formacie AudioData.

Aby przekonwertować obiekt AudioFile na AudioData, użyjemy metody record() klasy Recognizer wraz z menedżerem kontekstu. Metoda record() przyjmuje obiekt AudioFile i przekształca go w AudioData, gotowy do użycia z metodą recognize_google().

Biblioteka SpeechRecognition została już zaimportowana jako sr.

To ćwiczenie jest częścią kursu

Przetwarzanie mowy w Pythonie

Zobacz kurs

Instrukcje do ćwiczenia

  • Przekaż do klasy AudioFile plik clean_support_call.wav.
  • Użyj menedżera kontekstu, aby otworzyć i odczytać clean_support_call jako source.
  • Nagraj source i uruchom kod.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
Edytuj i uruchom kod