Od AudioFile do AudioData
Jak już widziałeś(-aś) wcześniej, dane audio wymagają kilku kroków przekształcenia, zanim będzie można je efektywnie wykorzystać. Podobnie jest w przypadku biblioteki SpeechRecognition.
W tym ćwiczeniu zaimportujesz plik audio clean_support_call.wav (pobierz tutaj) i przygotowujesz go do rozpoznawania mowy.
Plik audio wczytujemy za pomocą klasy AudioFile. Jednak metoda recognize_google() wymaga danych w formacie AudioData.
Aby przekonwertować obiekt AudioFile na AudioData, użyjemy metody record() klasy Recognizer wraz z menedżerem kontekstu. Metoda record() przyjmuje obiekt AudioFile i przekształca go w AudioData, gotowy do użycia z metodą recognize_google().
Biblioteka SpeechRecognition została już zaimportowana jako sr.
To ćwiczenie jest częścią kursu
Przetwarzanie mowy w Pythonie
Instrukcje do ćwiczenia
- Przekaż do klasy
AudioFileplikclean_support_call.wav. - Użyj menedżera kontekstu, aby otworzyć i odczytać
clean_support_calljakosource. - Nagraj
sourcei uruchom kod.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Instantiate Recognizer
recognizer = sr.Recognizer()
# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)
# Convert AudioFile to AudioData
with ____ as source:
clean_support_call_audio = recognizer.record(____)
# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
language="en-US")
print(text)