Inizia subitoInizia gratis

Da AudioFile ad AudioData

Come hai visto in precedenza, ci sono alcuni passaggi di trasformazione necessari per rendere utile l'audio. Lo stesso vale per SpeechRecognition.

In questo esercizio importeremo il file audio clean_support_call.wav e lo prepareremo per il riconoscimento.

Per prima cosa leggiamo il file audio usando la classe AudioFile. Tuttavia, il metodo recognize_google() richiede un input di tipo AudioData.

Per convertire il nostro AudioFile in AudioData, useremo il metodo record() della classe Recognizer insieme a un context manager. Il metodo record() prende in input un AudioFile e lo converte in AudioData, pronto per essere usato con recognize_google().

SpeechRecognition è già stato importato come sr.

Questo esercizio fa parte del corso

Elaborazione del linguaggio parlato in Python

Visualizza corso

Istruzioni dell'esercizio

  • Passa alla classe AudioFile clean_support_call.wav.
  • Usa il context manager per aprire e leggere clean_support_call come source.
  • Registra source ed esegui il codice.

esercizio interattivo pratico

Prova questo esercizio completando questo codice di esempio.

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
Modifica ed esegui il codice