使用 PyDub 讀取音訊參數
你處理的每個音訊檔都會有多個特性,例如聲道數、取樣率(frame rate 或 sample rate)、取樣寬度等。
了解這些參數,有助於確保你的音訊檔能符合各種語音轉錄 API 的需求。
例如,許多 API 建議最低取樣率(wav_file.frame_rate)為 16,000 Hz。
當你建立 AudioSegment 物件時,PyDub 會自動從音訊檔推斷這些參數,並以屬性形式儲存。
在這個練習中,我們會一起查看這些屬性。
本練習屬於課程
Python 的口語語言處理
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")
# Find the frame rate
print(wav_file.____)