Ajuster les paramètres audio
Lors de votre analyse exploratoire des données, vous pourriez constater que certains paramètres de vos fichiers audio diffèrent ou sont incompatibles avec des API de reconnaissance de la parole.
Pas d'inquiétude, PyDub offre des fonctions intégrées qui vous permettent de modifier divers attributs.
Par exemple, vous pouvez définir la fréquence d'échantillonnage de votre fichier audio en appelant set_frame_rate() sur votre instance AudioSegment et en lui passant un nombre entier correspondant à la fréquence souhaitée, en hertz.
Dans cet exercice, nous allons pratiquer la modification de quelques attributs audio.
Cette activité fait partie du cours
Traitement de la langue parlée en Python
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")
# Create a new wav file with adjusted frame rate
wav_file_16k = wav_file.____(____)
# Check the frame rate of the new wav file
print(wav_file_16k.____)