Paramètres audio avec PyDub
Chaque fichier audio avec lequel vous travaillez comporte plusieurs caractéristiques, comme le nombre de canaux, la cadence d'images (ou fréquence d'échantillonnage), la largeur d'échantillon, et plus encore.
Connaître ces paramètres est utile pour s'assurer que vos fichiers audio respectent les exigences de diverses API de transcription de la parole.
Par exemple, plusieurs API recommandent une cadence d'images minimale (wav_file.frame_rate) de 16 000 Hz.
Quand vous créez une instance de AudioSegment, PyDub déduit automatiquement ces paramètres à partir de vos fichiers audio et les enregistre comme attributs.
Dans cet exercice, nous allons explorer ces attributs.
Cette activité fait partie du cours
Traitement de la langue parlée en Python
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")
# Find the frame rate
print(wav_file.____)