Plusieurs interlocuteurs 1
Si votre objectif est de transcrire des conversations, il y aura plus d'un interlocuteur. Cependant, comme vous allez le voir, la fonction recognize_google() ne transcrit la parole qu'en un seul bloc de texte.
Dans ce fichier audio, vous pouvez entendre trois personnes différentes.
Mais si vous le transcrivez tel quel, recognize_google() renvoie un seul bloc de texte. C'est quand même utile, mais cela ne vous indique pas qui a dit quoi.
Nous verrons une alternative à cela dans le prochain exercice.
Le fichier audio avec plusieurs interlocuteurs a été importé et converti en AudioData sous le nom multiple_speakers.
Cette activité fait partie du cours
Traitement de la langue parlée en Python
Instructions de l’exercice
- Créez une instance de
Recognizer. - Transcrivez la variable
multiple_speakersà l'aide de la fonctionrecognize_google(). - Définissez la langue à l'anglais des États-Unis (
"en-US").
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)