开始使用免费开始使用

一个音频处理工作流

您已经了解了如何使用 PyDub 导入并操作单个音频文件。那如果有一个文件夹里包含多个需要转换的音频文件,该怎么办呢?

在本练习中,我们将使用 PyDub 将一个文件夹中的文件统一格式化,以便在 speech_recognition 中使用。

您发现客户来电录音在开头都有 3 秒的静电噪声,而且整体音量偏小。

为了解决这些问题,我们会用 PyDub 剪掉静电、提高音量,并将它们转换为 .wav 扩展名。

您可以在此处收听未格式化的示例:here

本练习是课程的一部分

Python 语音语言处理

查看课程

交互式实操练习

通过完成这段示例代码来试试这个练习。

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
编辑并运行代码