Più interlocutori 1
Se il tuo obiettivo è trascrivere conversazioni, ci saranno più di un interlocutore. Tuttavia, come vedrai, la funzione recognize_google() trascrive il parlato in un unico blocco di testo.
In questo file audio puoi sentire tre voci diverse.
Ma se lo trascrivi così com'è, recognize_google() restituisce un singolo blocco di testo. È comunque utile, ma non ti dice quale interlocutore ha detto cosa.
Vedremo un'alternativa a questo nel prossimo esercizio.
Il file audio con più interlocutori è stato importato e convertito in AudioData come multiple_speakers.
Questo esercizio fa parte del corso
Elaborazione del linguaggio parlato in Python
Istruzioni dell'esercizio
- Crea un'istanza di
Recognizer. - Riconosci la variabile
multiple_speakersusando la funzionerecognize_google(). - Imposta la lingua su inglese USA (
"en-US").
esercizio interattivo pratico
Prova questo esercizio completando questo codice di esempio.
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)