Bắt đầu ngayBắt đầu miễn phí

Từ AudioFile đến AudioData

Như bạn đã thấy trước đó, chúng ta cần một số bước chuyển đổi để dữ liệu âm thanh trở nên hữu ích. SpeechRecognition cũng vậy.

Trong bài này, bạn sẽ nhập tệp âm thanh clean_support_call.wav và chuẩn bị để tiến hành nhận dạng.

Trước tiên, chúng ta đọc tệp âm thanh bằng lớp AudioFile. Tuy nhiên, phương thức recognize_google() yêu cầu đầu vào kiểu AudioData.

Để chuyển AudioFile sang AudioData, chúng ta sẽ dùng phương thức record() của lớp Recognizer cùng với một context manager. Phương thức record() nhận một AudioFile làm đầu vào và chuyển nó thành AudioData, sẵn sàng dùng với recognize_google().

SpeechRecognition đã được nhập với bí danh sr.

Bài tập này là một phần của khóa học

Xử lý Ngôn ngữ Nói bằng Python

Xem khóa học

Hướng dẫn bài tập

  • Truyền lớp AudioFile với tệp clean_support_call.wav.
  • Dùng context manager để mở và đọc clean_support_call dưới tên source.
  • Ghi âm từ source và chạy mã.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
Chỉnh sửa và Chạy Mã