Ljudparametrar med PyDub
Varje ljudfil du arbetar med har ett antal egenskaper kopplade till sig, till exempel kanaler, samplingsfrekvens (frame rate), samplingsstorlek och mer.
Att känna till dessa parametrar är viktigt för att säkerställa att dina ljudfiler är kompatibla med de krav som olika API:er ställer för taltranskription.
Många API:er rekommenderar till exempel en minsta samplingsfrekvens (wav_file.frame_rate) på 16 000 Hz.
När du skapar en instans av AudioSegment läser PyDub automatiskt av dessa parametrar från din ljudfil och sparar dem som attribut.
I den här övningen utforskar vi dessa attribut.
Den här övningen är en del av kursen
Taligenkänning i Python
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")
# Find the frame rate
print(wav_file.____)