开始使用免费开始使用

从 AudioFile 到 AudioData

正如您之前所见,我们需要对音频数据做一些转换,才能让它真正有用。使用 SpeechRecognition 也一样。

在本练习中,您将导入 clean_support_call.wav 音频文件,并让它准备好进行识别。

我们先使用 AudioFile 类读取音频文件。但 recognize_google() 方法需要的输入类型是 AudioData

要将 AudioFile 转换为 AudioData,我们将配合上下文管理器使用 Recognizer 类的 record() 方法。record() 方法以 AudioFile 为输入,并将其转换为 AudioData,可直接用于 recognize_google()

SpeechRecognition 已以 sr 导入。

本练习是课程的一部分

Python 语音语言处理

查看课程

练习说明

  • clean_support_call.wav 传给 AudioFile 类。
  • 使用上下文管理器将 clean_support_callsource 的名称打开并读取。
  • 录制 source 并运行代码。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
编辑并运行代码