多位说话者 1
如果您的目标是转写对话,通常会有不止一位说话者。然而,正如您将看到的,recognize_google() 函数只会把语音转成一整段文本。
您可以在这个音频文件里听到共有 3 位不同的说话者。
但如果直接对其进行转写,recognize_google() 会返回单个文本块。虽然依然有用,但它不会告诉您是哪位说话者说了什么。
我们将在下一个练习中看到一种替代方案。
多说话者的音频文件已导入并转换为 AudioData,变量名为 multiple_speakers。
本练习是课程的一部分
Python 语音语言处理
练习说明
- 创建一个
Recognizer实例。 - 使用
recognize_google()函数识别变量multiple_speakers。 - 将语言设置为美国英语(
"en-US")。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)