Chuyển âm thanh thành văn bản chỉ với một dòng
Được rồi, giờ bạn đã có các hàm để chuyển đổi tệp âm thanh và lấy thuộc tính của chúng, đến lúc xây dựng một hàm để phiên âm chúng.
Trong bài này, bạn sẽ xây dựng transcribe_audio() nhận filename làm đầu vào, nhập filename bằng lớp AudioFile của speech_recognition, rồi phiên âm bằng recognize_google().
Bạn đã thấy các hàm này trước đó, nhưng bây giờ chúng ta sẽ ghép chúng lại để dùng thuận tiện trong một hàm.
Để thử nghiệm, chúng ta sẽ phiên âm cuộc gọi đầu tiên của Acme, "call_1.wav".
speech_recognition đã được nhập với bí danh sr.
Bài tập này là một phần của khóa học
Xử lý Ngôn ngữ Nói bằng Python
Hướng dẫn bài tập
- Định nghĩa một hàm tên
transcribe_audionhậnfilenamelàm tham số đầu vào. - Tạo một thể hiện
Recognizer()và gán chorecognizer. - Dùng
recognize_google()để phiên âm dữ liệu âm thanh. - Truyền cuộc gọi mục tiêu vào hàm.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
____ ____(____):
"""Takes a .wav format audio file and transcribes it to text."""
# Setup a recognizer instance
____ = sr.Recognizer()
# Import the audio file and convert to audio data
audio_file = sr.AudioFile(filename)
with audio_file as source:
audio_data = recognizer.record(source)
# Return the transcribed text
return recognizer.____(audio_data)
# Test the function
print(transcribe_audio(____))