เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

ถอดเสียงเป็นข้อความด้วยโค้ดบรรทัดเดียว

ตอนนี้มีฟังก์ชันสำหรับแปลงไฟล์เสียงและตรวจสอบคุณสมบัติของไฟล์แล้ว ถึงเวลาสร้างฟังก์ชันสำหรับถอดเสียงเป็นข้อความกัน

ในแบบฝึกหัดนี้ จะสร้างฟังก์ชัน transcribe_audio() ที่รับ filename เป็น input จากนั้นนำเข้าไฟล์โดยใช้คลาส AudioFile ของ speech_recognition แล้วถอดเสียงด้วย recognize_google()

ฟังก์ชันเหล่านี้เคยเห็นมาแล้ว แต่คราวนี้จะนำมารวมกันไว้ในฟังก์ชันเดียวเพื่อให้ใช้งานได้สะดวก

เพื่อทดสอบ จะลองถอดเสียงสายแรกของ Acme ที่ชื่อว่า "call_1.wav"

นำเข้า speech_recognition เป็น sr ไว้แล้ว

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

Spoken Language Processing ด้วย Python

ดูคอร์ส

คำแนะนำการฝึกหัด

  • กำหนดฟังก์ชันชื่อ transcribe_audio โดยรับ filename เป็น input parameter
  • สร้าง instance ของ Recognizer() แล้วกำหนดให้กับตัวแปร recognizer
  • ใช้ recognize_google() เพื่อถอดเสียงเป็นข้อความ
  • ส่งไฟล์สายที่ต้องการไปยังฟังก์ชัน

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

____ ____(____):
  """Takes a .wav format audio file and transcribes it to text."""
  # Setup a recognizer instance
  ____ = sr.Recognizer()
  
  # Import the audio file and convert to audio data
  audio_file = sr.AudioFile(filename)
  with audio_file as source:
    audio_data = recognizer.record(source)
  
  # Return the transcribed text
  return recognizer.____(audio_data)

# Test the function
print(transcribe_audio(____))
แก้ไขและรันโค้ด