จาก AudioFile สู่ AudioData
อย่างที่เห็นไปก่อนหน้านี้ การเตรียมข้อมูลเสียงให้พร้อมใช้งานต้องผ่านขั้นตอนการแปลงข้อมูลหลายขั้นตอน SpeechRecognition ก็เช่นเดียวกัน
ในแบบฝึกหัดนี้ เราจะนำเข้าไฟล์เสียง clean_support_call.wav audio file และเตรียมให้พร้อมสำหรับการแปลงเสียงเป็นข้อความ
เริ่มต้นด้วยการอ่านไฟล์เสียงผ่านคลาส AudioFile แต่เมธอด recognize_google() ต้องการ input ที่เป็นประเภท AudioData
เพื่อแปลง AudioFile ให้เป็น AudioData เราจะใช้เมธอด record() ของคลาส Recognizer ร่วมกับ context manager โดยเมธอด record() จะรับ AudioFile เป็น input แล้วแปลงเป็น AudioData ที่พร้อมใช้งานกับ recognize_google()
ไลบรารี SpeechRecognition ถูก import ไว้แล้วในชื่อ sr
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Spoken Language Processing ด้วย Python
คำแนะนำการฝึกหัด
- ส่งชื่อไฟล์
clean_support_call.wavให้กับคลาส AudioFile - ใช้ context manager เพื่อเปิดและอ่าน
clean_support_callในชื่อsource - บันทึก
sourceแล้วรันโค้ด
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Instantiate Recognizer
recognizer = sr.Recognizer()
# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)
# Convert AudioFile to AudioData
with ____ as source:
clean_support_call_audio = recognizer.record(____)
# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
language="en-US")
print(text)