CommencezCommencez gratuitement

Normaliser un fichier audio avec PyDub

Il arrive que certains fichiers audio contiennent des passages où la voix est forte, puis d'autres où elle est faible. Cette variation de volume peut nuire à la transcription.

Heureusement, le module d'effets de PyDub offre une fonction appelée normalize() qui repère le volume maximal d'un AudioSegment, puis ajuste le reste de l'AudioSegment en conséquence. Autrement dit, les passages plus calmes gagnent en volume.

Vous pouvez écouter un exemple de fichier audio qui commence fort puis devient plus faible, loud_then_quiet.wav, ici.

Dans cet exercice, vous utiliserez normalize() pour uniformiser le volume de notre fichier, afin qu'il sonne plutôt comme ceci.

Cette activité fait partie du cours

Traitement de la langue parlée en Python

Voir le cours

Instructions de l’exercice

  • Importez AudioSegment depuis PyDub et normalize depuis le module d'effets de PyDub.
  • Importez le fichier audio cible, loud_then_quiet.wav, et enregistrez-le dans loud_then_quiet.
  • Normalisez le fichier audio importé à l'aide de la fonction normalize() et enregistrez le résultat dans normalized_loud_then_quiet.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Import AudioSegment and normalize
from pydub import ____
from pydub.effects import ____

# Import target audio file
loud_then_quiet = AudioSegment.from_file(____)

# Normalize target audio file
normalized_loud_then_quiet = ____(____)
Modifier et exécuter le code