Inizia subitoInizia gratis

Trascrivere audio con una sola riga

Bene, ora che hai funzioni per convertire i file audio e leggerne gli attributi, è il momento di crearne una per trascriverli.

In questo esercizio costruirai transcribe_audio(), che prende in input un filename, importa il filename usando la classe AudioFile di speech_recognition e poi lo trascrive con recognize_google().

Hai già visto queste funzioni, ma ora le metteremo insieme in modo che siano accessibili all'interno di una funzione.

Per provarla, trascriveremo la prima chiamata di Acme, "call_1.wav".

speech_recognition è stato importato come sr.

Questo esercizio fa parte del corso

Elaborazione del linguaggio parlato in Python

Visualizza corso

Istruzioni dell'esercizio

  • Definisci una funzione chiamata transcribe_audio che accetta filename come parametro di input.
  • Crea un'istanza di Recognizer() e assegnala a recognizer.
  • Usa recognize_google() per trascrivere i dati audio.
  • Passa la chiamata di destinazione alla funzione.

esercizio interattivo pratico

Prova questo esercizio completando questo codice di esempio.

____ ____(____):
  """Takes a .wav format audio file and transcribes it to text."""
  # Setup a recognizer instance
  ____ = sr.Recognizer()
  
  # Import the audio file and convert to audio data
  audio_file = sr.AudioFile(filename)
  with audio_file as source:
    audio_data = recognizer.record(source)
  
  # Return the transcribed text
  return recognizer.____(audio_data)

# Test the function
print(transcribe_audio(____))
Modifica ed esegui il codice