Nhiều người nói 1
Nếu mục tiêu của bạn là phiên âm các cuộc hội thoại, sẽ có nhiều hơn một người nói. Tuy nhiên, như bạn sẽ thấy, hàm recognize_google() chỉ phiên âm lời nói thành một khối văn bản duy nhất.
Bạn có thể nghe trong tệp âm thanh này có ba người nói khác nhau.
Nhưng nếu bạn phiên âm trực tiếp, recognize_google() sẽ trả về một khối văn bản duy nhất. Điều này vẫn hữu ích nhưng không cho bạn biết ai nói câu nào.
Chúng ta sẽ xem một cách làm khác trong bài tập tiếp theo.
Tệp âm thanh nhiều người nói đã được nhập và chuyển đổi thành AudioData với tên multiple_speakers.
Bài tập này là một phần của khóa học
Xử lý Ngôn ngữ Nói bằng Python
Hướng dẫn bài tập
- Tạo một thể hiện của
Recognizer. - Nhận dạng biến
multiple_speakersbằng hàmrecognize_google(). - Đặt ngôn ngữ là tiếng Anh Mỹ (
"en-US").
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)