Začněte nyníZačněte zdarma

Z AudioFile na AudioData

Jak jsi viděl/a dříve, aby byla audio data použitelná, je potřeba provést několik transformačních kroků. Stejné to je i u SpeechRecognition.

V tomto cvičení nahrajeme audio soubor clean_support_call.wav (odkaz) a připravíme ho k rozpoznání.

Audio soubor nejprve načteme pomocí třídy AudioFile. Metoda recognize_google() ale vyžaduje vstup typu AudioData.

Pro převod AudioFile na AudioData použijeme metodu record() třídy Recognizer spolu s kontextovým manažerem. Metoda record() přijme AudioFile jako vstup a převede ho na AudioData – připravené k použití s recognize_google().

SpeechRecognition je už naimportovaný jako sr.

Toto cvičení je součástí kurzu

Zpracování mluveného jazyka v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Předej třídě AudioFile soubor clean_support_call.wav.
  • Pomocí kontextového manažeru otevři a načti clean_support_call jako source.
  • Nahraj source a spusť kód.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
Upravit a spustit kód