一个音频处理工作流
您已经了解了如何使用 PyDub 导入并操作单个音频文件。那如果有一个文件夹里包含多个需要转换的音频文件,该怎么办呢?
在本练习中,我们将使用 PyDub 将一个文件夹中的文件统一格式化,以便在 speech_recognition 中使用。
您发现客户来电录音在开头都有 3 秒的静电噪声,而且整体音量偏小。
为了解决这些问题,我们会用 PyDub 剪掉静电、提高音量,并将它们转换为 .wav 扩展名。
您可以在此处收听未格式化的示例:here。
本练习是课程的一部分
Python 语音语言处理
交互式实操练习
通过完成这段示例代码来试试这个练习。
file_with_static = AudioSegment.from_file(____)
# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]