开始使用免费开始使用

录制所需的音频

有时,您可能并不需要处理整段音频文件。record() 方法的 durationoffset 参数可以帮到您。

在探索数据集后,您发现有一个文件(已导入为 nothing_at_end)在结尾处有30 秒的静音,还有一个客服通话文件(已导入为 out_of_warranty)在开头有3 秒的杂音

设置 durationoffset 意味着 record() 方法将从 offset 开始,录制最长为 duration 的音频。二者的单位均为秒。

本练习是课程的一部分

Python 语音语言处理

查看课程

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Convert AudioFile to AudioData
with nothing_at_end as source:
    nothing_at_end_audio = recognizer.record(source,
                                             duration=____,
                                             offset=None)

# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
                                   language="en-US")

print(text)
编辑并运行代码