CommencezCommencez gratuitement

Un enchaînement de traitement audio

Vous avez vu comment importer et manipuler un seul fichier audio avec PyDub. Mais que faire si vous avez un dossier contenant plusieurs fichiers audio à convertir?

Dans cet exercice, nous allons utiliser PyDub pour mettre en forme un dossier de fichiers afin qu'ils soient prêts à être utilisés avec speech_recognition.

Vous avez constaté que vos enregistrements d'appels clients comportent 3 secondes de statique au début et qu'ils sont plus faibles qu'ils ne pourraient l'être.

Pour corriger cela, nous allons utiliser PyDub pour couper la statique, augmenter le niveau sonore et les convertir à l'extension .wav.

Vous pouvez écouter un exemple non formaté ici.

Cette activité fait partie du cours

Traitement de la langue parlée en Python

Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
Modifier et exécuter le code