Bắt đầu ngayBắt đầu miễn phí

Chuyển âm thanh thành văn bản chỉ với một dòng

Được rồi, giờ bạn đã có các hàm để chuyển đổi tệp âm thanh và lấy thuộc tính của chúng, đến lúc xây dựng một hàm để phiên âm chúng.

Trong bài này, bạn sẽ xây dựng transcribe_audio() nhận filename làm đầu vào, nhập filename bằng lớp AudioFile của speech_recognition, rồi phiên âm bằng recognize_google().

Bạn đã thấy các hàm này trước đó, nhưng bây giờ chúng ta sẽ ghép chúng lại để dùng thuận tiện trong một hàm.

Để thử nghiệm, chúng ta sẽ phiên âm cuộc gọi đầu tiên của Acme, "call_1.wav".

speech_recognition đã được nhập với bí danh sr.

Bài tập này là một phần của khóa học

Xử lý Ngôn ngữ Nói bằng Python

Xem khóa học

Hướng dẫn bài tập

  • Định nghĩa một hàm tên transcribe_audio nhận filename làm tham số đầu vào.
  • Tạo một thể hiện Recognizer() và gán cho recognizer.
  • Dùng recognize_google() để phiên âm dữ liệu âm thanh.
  • Truyền cuộc gọi mục tiêu vào hàm.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

____ ____(____):
  """Takes a .wav format audio file and transcribes it to text."""
  # Setup a recognizer instance
  ____ = sr.Recognizer()
  
  # Import the audio file and convert to audio data
  audio_file = sr.AudioFile(filename)
  with audio_file as source:
    audio_data = recognizer.record(source)
  
  # Return the transcribed text
  return recognizer.____(audio_data)

# Test the function
print(transcribe_audio(____))
Chỉnh sửa và Chạy Mã