Inizia subitoInizia gratis

Più interlocutori 1

Se il tuo obiettivo è trascrivere conversazioni, ci saranno più di un interlocutore. Tuttavia, come vedrai, la funzione recognize_google() trascrive il parlato in un unico blocco di testo.

In questo file audio puoi sentire tre voci diverse.

Ma se lo trascrivi così com'è, recognize_google() restituisce un singolo blocco di testo. È comunque utile, ma non ti dice quale interlocutore ha detto cosa.

Vedremo un'alternativa a questo nel prossimo esercizio.

Il file audio con più interlocutori è stato importato e convertito in AudioData come multiple_speakers.

Questo esercizio fa parte del corso

Elaborazione del linguaggio parlato in Python

Visualizza corso

Istruzioni dell'esercizio

  • Crea un'istanza di Recognizer.
  • Riconosci la variabile multiple_speakers usando la funzione recognize_google().
  • Imposta la lingua su inglese USA ("en-US").

esercizio interattivo pratico

Prova questo esercizio completando questo codice di esempio.

# Create a recognizer class
recognizer = sr.____()

# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____, 
                       			   language=____)

# Print the text
print(text)
Modifica ed esegui il codice