Từ AudioFile đến AudioData
Như bạn đã thấy trước đó, chúng ta cần một số bước chuyển đổi để dữ liệu âm thanh trở nên hữu ích. SpeechRecognition cũng vậy.
Trong bài này, bạn sẽ nhập tệp âm thanh clean_support_call.wav và chuẩn bị để tiến hành nhận dạng.
Trước tiên, chúng ta đọc tệp âm thanh bằng lớp AudioFile. Tuy nhiên, phương thức recognize_google() yêu cầu đầu vào kiểu AudioData.
Để chuyển AudioFile sang AudioData, chúng ta sẽ dùng phương thức record() của lớp Recognizer cùng với một context manager. Phương thức record() nhận một AudioFile làm đầu vào và chuyển nó thành AudioData, sẵn sàng dùng với recognize_google().
SpeechRecognition đã được nhập với bí danh sr.
Bài tập này là một phần của khóa học
Xử lý Ngôn ngữ Nói bằng Python
Hướng dẫn bài tập
- Truyền lớp AudioFile với tệp
clean_support_call.wav. - Dùng context manager để mở và đọc
clean_support_calldưới tênsource. - Ghi âm từ
sourcevà chạy mã.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Instantiate Recognizer
recognizer = sr.Recognizer()
# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)
# Convert AudioFile to AudioData
with ____ as source:
clean_support_call_audio = recognizer.record(____)
# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
language="en-US")
print(text)