Transkribera ljud med en rad
Nu har du funktioner för att konvertera ljudfiler och ta reda på deras egenskaper – dags att bygga en funktion som transkriberar dem.
I den här övningen bygger du transcribe_audio(), som tar ett filename som indata, importerar filen med speech_recognitions klass AudioFile och transkriberar den med recognize_google().
Du har sett de här funktionerna tidigare, men nu sätter vi ihop dem så att de är tillgängliga i en och samma funktion.
För att testa transkriberar vi Acmes första samtal, "call_1.wav".
speech_recognition har importerats som sr.
Den här övningen är en del av kursen
Taligenkänning i Python
Övningsinstruktioner
- Definiera en funktion som heter
transcribe_audiooch som tarfilenamesom indataparameter. - Skapa en
Recognizer()-instans och spara den somrecognizer. - Använd
recognize_google()för att transkribera ljuddatan. - Skicka målsamtalet till funktionen.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
____ ____(____):
"""Takes a .wav format audio file and transcribes it to text."""
# Setup a recognizer instance
____ = sr.Recognizer()
# Import the audio file and convert to audio data
audio_file = sr.AudioFile(filename)
with audio_file as source:
audio_data = recognizer.record(source)
# Return the transcribed text
return recognizer.____(audio_data)
# Test the function
print(transcribe_audio(____))