CommencezCommencez gratuitement

Paramètres audio avec PyDub

Chaque fichier audio avec lequel vous travaillez comporte plusieurs caractéristiques, comme le nombre de canaux, la cadence d'images (ou fréquence d'échantillonnage), la largeur d'échantillon, et plus encore.

Connaître ces paramètres est utile pour s'assurer que vos fichiers audio respectent les exigences de diverses API de transcription de la parole.

Par exemple, plusieurs API recommandent une cadence d'images minimale (wav_file.frame_rate) de 16 000 Hz.

Quand vous créez une instance de AudioSegment, PyDub déduit automatiquement ces paramètres à partir de vos fichiers audio et les enregistre comme attributs.

Dans cet exercice, nous allons explorer ces attributs.

Cette activité fait partie du cours

Traitement de la langue parlée en Python

Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")

# Find the frame rate
print(wav_file.____)
Modifier et exécuter le code