Kom igångKom igång gratis

Transkribera ljud med en rad

Nu har du funktioner för att konvertera ljudfiler och ta reda på deras egenskaper – dags att bygga en funktion som transkriberar dem.

I den här övningen bygger du transcribe_audio(), som tar ett filename som indata, importerar filen med speech_recognitions klass AudioFile och transkriberar den med recognize_google().

Du har sett de här funktionerna tidigare, men nu sätter vi ihop dem så att de är tillgängliga i en och samma funktion.

För att testa transkriberar vi Acmes första samtal, "call_1.wav".

speech_recognition har importerats som sr.

Den här övningen är en del av kursen

Taligenkänning i Python

Visa kurs

Övningsinstruktioner

  • Definiera en funktion som heter transcribe_audio och som tar filename som indataparameter.
  • Skapa en Recognizer()-instans och spara den som recognizer.
  • Använd recognize_google() för att transkribera ljuddatan.
  • Skicka målsamtalet till funktionen.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

____ ____(____):
  """Takes a .wav format audio file and transcribes it to text."""
  # Setup a recognizer instance
  ____ = sr.Recognizer()
  
  # Import the audio file and convert to audio data
  audio_file = sr.AudioFile(filename)
  with audio_file as source:
    audio_data = recognizer.record(source)
  
  # Return the transcribed text
  return recognizer.____(audio_data)

# Test the function
print(transcribe_audio(____))
Redigera och kör kod