Kom igångKom igång gratis

Från AudioFile till AudioData

Som du såg tidigare behöver vi utföra vissa transformationssteg för att göra våra ljuddata användbara. Detsamma gäller för SpeechRecognition.

I den här övningen importerar vi ljudfilen clean_support_call.wav audio file och gör den redo för igenkänning.

Vi läser först in ljudfilen med klassen AudioFile. Men metoden recognize_google() kräver indata av typen AudioData.

För att konvertera vår AudioFile till AudioData använder vi metoden record() från klassen Recognizer tillsammans med en kontexthanterare. Metoden record() tar en AudioFile som indata och konverterar den till AudioData, redo att användas med recognize_google().

SpeechRecognition har redan importerats som sr.

Den här övningen är en del av kursen

Taligenkänning i Python

Visa kurs

Övningsinstruktioner

  • Skicka filnamnet clean_support_call.wav till klassen AudioFile.
  • Använd kontexthanteraren för att öppna och läsa clean_support_call som source.
  • Spela in source och kör koden.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
Redigera och kör kod