开始使用免费开始使用

多位说话者 1

如果您的目标是转写对话,通常会有不止一位说话者。然而,正如您将看到的,recognize_google() 函数只会把语音转成一整段文本。

您可以在这个音频文件里听到共有 3 位不同的说话者。

但如果直接对其进行转写,recognize_google() 会返回单个文本块。虽然依然有用,但它不会告诉您是哪位说话者说了什么。

我们将在下一个练习中看到一种替代方案。

多说话者的音频文件已导入并转换为 AudioData,变量名为 multiple_speakers

本练习是课程的一部分

Python 语音语言处理

查看课程

练习说明

  • 创建一个 Recognizer 实例。
  • 使用 recognize_google() 函数识别变量 multiple_speakers
  • 将语言设置为美国英语("en-US")。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Create a recognizer class
recognizer = sr.____()

# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____, 
                       			   language=____)

# Print the text
print(text)
编辑并运行代码