เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

จาก AudioFile สู่ AudioData

อย่างที่เห็นไปก่อนหน้านี้ การเตรียมข้อมูลเสียงให้พร้อมใช้งานต้องผ่านขั้นตอนการแปลงข้อมูลหลายขั้นตอน SpeechRecognition ก็เช่นเดียวกัน

ในแบบฝึกหัดนี้ เราจะนำเข้าไฟล์เสียง clean_support_call.wav audio file และเตรียมให้พร้อมสำหรับการแปลงเสียงเป็นข้อความ

เริ่มต้นด้วยการอ่านไฟล์เสียงผ่านคลาส AudioFile แต่เมธอด recognize_google() ต้องการ input ที่เป็นประเภท AudioData

เพื่อแปลง AudioFile ให้เป็น AudioData เราจะใช้เมธอด record() ของคลาส Recognizer ร่วมกับ context manager โดยเมธอด record() จะรับ AudioFile เป็น input แล้วแปลงเป็น AudioData ที่พร้อมใช้งานกับ recognize_google()

ไลบรารี SpeechRecognition ถูก import ไว้แล้วในชื่อ sr

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

Spoken Language Processing ด้วย Python

ดูคอร์ส

คำแนะนำการฝึกหัด

  • ส่งชื่อไฟล์ clean_support_call.wav ให้กับคลาส AudioFile
  • ใช้ context manager เพื่อเปิดและอ่าน clean_support_call ในชื่อ source
  • บันทึก source แล้วรันโค้ด

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
แก้ไขและรันโค้ด