Bắt đầu ngayBắt đầu miễn phí

Sử dụng lớp Recognizer

Giờ bạn đã tạo một instance của lớp Recognizer, chúng ta sẽ dùng method recognize_google() trên đó để truy cập Google Web Speech API và chuyển lời nói thành văn bản.

recognize_google() yêu cầu tham số audio_data, nếu không sẽ báo lỗi.

Tiếng Anh (US) là ngôn ngữ mặc định. Nếu tệp âm thanh của bạn không phải tiếng Anh (US), bạn có thể đổi ngôn ngữ bằng tham số language. Danh sách mã ngôn ngữ có thể xem tại đây.

Một tệp âm thanh chứa tiếng Anh đã được nhập là clean_support_call_audio. Bạn có thể nghe tệp âm thanh tại đây. SpeechRecognition cũng đã được nhập là sr.

Để tránh vượt giới hạn số lần gọi API của Google Web API, chúng tôi đã giả lập (mock) lớp Recognizer để làm việc với các tệp âm thanh của chúng ta. Điều này đồng nghĩa một số chức năng sẽ bị hạn chế.

Bài tập này là một phần của khóa học

Xử lý Ngôn ngữ Nói bằng Python

Xem khóa học

Hướng dẫn bài tập

  • Gọi method recognize_google() trên recognizer và truyền vào clean_support_call_audio.
  • Đặt tham số language thành "en-US".

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Create a recognizer class
recognizer = sr.Recognizer()

# Transcribe the support call audio
text = ____.____(
  audio_data=____, 
  language=____)

print(text)
Chỉnh sửa và Chạy Mã