CommencezCommencez gratuitement

Plusieurs interlocuteurs 1

Si votre objectif est de transcrire des conversations, il y aura plus d'un interlocuteur. Cependant, comme vous allez le voir, la fonction recognize_google() ne transcrit la parole qu'en un seul bloc de texte.

Dans ce fichier audio, vous pouvez entendre trois personnes différentes.

Mais si vous le transcrivez tel quel, recognize_google() renvoie un seul bloc de texte. C'est quand même utile, mais cela ne vous indique pas qui a dit quoi.

Nous verrons une alternative à cela dans le prochain exercice.

Le fichier audio avec plusieurs interlocuteurs a été importé et converti en AudioData sous le nom multiple_speakers.

Cette activité fait partie du cours

Traitement de la langue parlée en Python

Voir le cours

Instructions de l’exercice

  • Créez une instance de Recognizer.
  • Transcrivez la variable multiple_speakers à l'aide de la fonction recognize_google().
  • Définissez la langue à l'anglais des États-Unis ("en-US").

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Create a recognizer class
recognizer = sr.____()

# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____, 
                       			   language=____)

# Print the text
print(text)
Modifier et exécuter le code