Préparer des fichiers audio pour la classification de texte
Acme est très impressionnée par votre travail jusqu'ici. Elle vous a donc envoyé deux autres dossiers de fichiers audio.
Un dossier s'appelle pre_purchase et contient des extraits audio de clients avant l'achat, comme pre_purchase_audio_25.mp3 (file).
L'autre s'appelle post_purchase et contient des extraits audio de clients ayant effectué un achat (après-achat), comme post_purchase_audio_27.mp3 (file).
En examinant les fichiers, vous constatez qu'il y en a environ 50 dans chaque dossier et qu'ils sont au format .mp3.
Acme veut savoir si vous pouvez créer un classificateur pour catégoriser les appels à venir. Vous leur répondez que oui, absolument.
Dans cet exercice, vous parcourrez chaque dossier et convertirez les fichiers audio au format .wav à l'aide de convert_to_wav() afin de pouvoir les transcrire.
Cette activité fait partie du cours
Traitement de la langue parlée en Python
Instructions de l’exercice
- Convertissez les fichiers dans
pre_purchaseau format.wavà l'aide deconvert_to_wav(). - Convertissez les fichiers dans
post_purchaseau format.wavà l'aide deconvert_to_wav().
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Convert post purchase
for file in post_purchase:
print(f"Converting {file} to .wav...")
convert_to_wav(____)
# Convert pre purchase
for file in ____:
print(f"Converting {file} to .wav...")
____(file)