开始使用免费开始使用

使用 Recognizer 类

现在您已经创建了一个 Recognizer 类的实例,将在其上使用 recognize_google() 方法,访问 Google 的 Web 语音 API,把语音转成文本。

recognize_google() 需要参数 audio_data,否则会报错。

默认语言是美式英语 (US English)。如果您的音频文件不是美式英语,可以通过 language 参数更改语言。语言代码列表见此处

一个包含英语语音的音频文件已作为 clean_support_call_audio 导入。您可以在这里收听该音频文件。SpeechRecognition 也已作为 sr 导入。

为避免触发 Google Web API 的请求速率限制,我们对 Recognizer 类进行了模拟,以便与我们的音频文件配合使用。这意味着某些功能会受限。

本练习是课程的一部分

Python 语音语言处理

查看课程

练习说明

  • recognizer 上调用 recognize_google() 方法,并传入 clean_support_call_audio
  • 将 language 参数设为 "en-US"

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Create a recognizer class
recognizer = sr.Recognizer()

# Transcribe the support call audio
text = ____.____(
  audio_data=____, 
  language=____)

print(text)
编辑并运行代码