Z AudioFile na AudioData
Jak jsi viděl/a dříve, aby byla audio data použitelná, je potřeba provést několik transformačních kroků. Stejné to je i u SpeechRecognition.
V tomto cvičení nahrajeme audio soubor clean_support_call.wav (odkaz) a připravíme ho k rozpoznání.
Audio soubor nejprve načteme pomocí třídy AudioFile. Metoda recognize_google() ale vyžaduje vstup typu AudioData.
Pro převod AudioFile na AudioData použijeme metodu record() třídy Recognizer spolu s kontextovým manažerem. Metoda record() přijme AudioFile jako vstup a převede ho na AudioData – připravené k použití s recognize_google().
SpeechRecognition je už naimportovaný jako sr.
Toto cvičení je součástí kurzu
Zpracování mluveného jazyka v Pythonu
Pokyny k cvičení
- Předej třídě
AudioFilesouborclean_support_call.wav. - Pomocí kontextového manažeru otevři a načti
clean_support_calljakosource. - Nahraj
sourcea spusť kód.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Instantiate Recognizer
recognizer = sr.Recognizer()
# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)
# Convert AudioFile to AudioData
with ____ as source:
clean_support_call_audio = recognizer.record(____)
# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
language="en-US")
print(text)