CommencezCommencez gratuitement

D'AudioFile à AudioData

Comme vous l'avez vu plus tôt, il faut effectuer certaines transformations pour rendre nos données audio exploitables. C'est pareil avec SpeechRecognition.

Dans cet exercice, nous allons importer le fichier audio clean_support_call.wav et le préparer pour la reconnaissance.

Nous lisons d'abord le fichier audio à l'aide de la classe AudioFile. Cependant, la méthode recognize_google() exige une entrée de type AudioData.

Pour convertir notre AudioFile en AudioData, nous utiliserons la méthode record() de la classe Recognizer avec un gestionnaire de contexte. La méthode record() reçoit un AudioFile en entrée et le convertit en AudioData, prêt à être utilisé avec recognize_google().

SpeechRecognition a déjà été importée sous le nom sr.

Cette activité fait partie du cours

Traitement de la langue parlée en Python

Voir le cours

Instructions de l’exercice

  • Passez à la classe AudioFile clean_support_call.wav.
  • Utilisez le gestionnaire de contexte pour ouvrir et lire clean_support_call comme source.
  • Enregistrez source et exécutez le code.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
Modifier et exécuter le code