Transcrire de l'audio en une seule ligne
Très bien, maintenant que vous avez des fonctions pour convertir des fichiers audio et en extraire les attributs, il est temps d'en créer une pour les transcrire.
Dans cet exercice, vous allez construire transcribe_audio() qui prend un filename en entrée, importe ce fichier à l'aide de la classe AudioFile de speech_recognition, puis le transcrit avec recognize_google().
Vous avez déjà vu ces fonctions, mais nous allons maintenant les rassembler pour qu'elles soient accessibles dans une seule fonction.
Pour l'essayer, nous allons transcrire le premier appel d'Acme, "call_1.wav".
speech_recognition a été importé sous le nom sr.
Cette activité fait partie du cours
Traitement de la langue parlée en Python
Instructions de l’exercice
- Définissez une fonction appelée
transcribe_audioqui prendfilenamecomme paramètre d'entrée. - Créez une instance de
Recognizer()nomméerecognizer. - Utilisez
recognize_google()pour transcrire les données audio. - Passez l'appel cible à la fonction.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
____ ____(____):
"""Takes a .wav format audio file and transcribes it to text."""
# Setup a recognizer instance
____ = sr.Recognizer()
# Import the audio file and convert to audio data
audio_file = sr.AudioFile(filename)
with audio_file as source:
audio_data = recognizer.record(source)
# Return the transcribed text
return recognizer.____(audio_data)
# Test the function
print(transcribe_audio(____))