音訊處理工作流程
你已經學會如何用 PyDub 匯入並操作單一音訊檔案。那如果有一個資料夾裡放著多個需要轉換的音訊檔呢?
在這個練習中,我們會用 PyDub 將整個資料夾的檔案格式化,讓它們可直接搭配 speech_recognition 使用。
你發現客戶來電的錄音在開頭都有 3 秒的靜電雜訊,整體音量也偏小。
為了修正這些問題,我們會用 PyDub 去除靜電雜訊、提高音量,並將副檔名轉為 .wav。
你可以在這裡先聽一個未格式化的範例:here。
本練習屬於課程
Python 的口語語言處理
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
file_with_static = AudioSegment.from_file(____)
# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]