Från AudioFile till AudioData
Som du såg tidigare behöver vi utföra vissa transformationssteg för att göra våra ljuddata användbara. Detsamma gäller för SpeechRecognition.
I den här övningen importerar vi ljudfilen clean_support_call.wav audio file och gör den redo för igenkänning.
Vi läser först in ljudfilen med klassen AudioFile. Men metoden recognize_google() kräver indata av typen AudioData.
För att konvertera vår AudioFile till AudioData använder vi metoden record() från klassen Recognizer tillsammans med en kontexthanterare. Metoden record() tar en AudioFile som indata och konverterar den till AudioData, redo att användas med recognize_google().
SpeechRecognition har redan importerats som sr.
Den här övningen är en del av kursen
Taligenkänning i Python
Övningsinstruktioner
- Skicka filnamnet
clean_support_call.wavtill klassen AudioFile. - Använd kontexthanteraren för att öppna och läsa
clean_support_callsomsource. - Spela in
sourceoch kör koden.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Instantiate Recognizer
recognizer = sr.Recognizer()
# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)
# Convert AudioFile to AudioData
with ____ as source:
clean_support_call_audio = recognizer.record(____)
# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
language="en-US")
print(text)