ถอดเสียงเป็นข้อความด้วยโค้ดบรรทัดเดียว
ตอนนี้มีฟังก์ชันสำหรับแปลงไฟล์เสียงและตรวจสอบคุณสมบัติของไฟล์แล้ว ถึงเวลาสร้างฟังก์ชันสำหรับถอดเสียงเป็นข้อความกัน
ในแบบฝึกหัดนี้ จะสร้างฟังก์ชัน transcribe_audio() ที่รับ filename เป็น input จากนั้นนำเข้าไฟล์โดยใช้คลาส AudioFile ของ speech_recognition แล้วถอดเสียงด้วย recognize_google()
ฟังก์ชันเหล่านี้เคยเห็นมาแล้ว แต่คราวนี้จะนำมารวมกันไว้ในฟังก์ชันเดียวเพื่อให้ใช้งานได้สะดวก
เพื่อทดสอบ จะลองถอดเสียงสายแรกของ Acme ที่ชื่อว่า "call_1.wav"
นำเข้า speech_recognition เป็น sr ไว้แล้ว
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Spoken Language Processing ด้วย Python
คำแนะนำการฝึกหัด
- กำหนดฟังก์ชันชื่อ
transcribe_audioโดยรับfilenameเป็น input parameter - สร้าง instance ของ
Recognizer()แล้วกำหนดให้กับตัวแปรrecognizer - ใช้
recognize_google()เพื่อถอดเสียงเป็นข้อความ - ส่งไฟล์สายที่ต้องการไปยังฟังก์ชัน
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
____ ____(____):
"""Takes a .wav format audio file and transcribes it to text."""
# Setup a recognizer instance
____ = sr.Recognizer()
# Import the audio file and convert to audio data
audio_file = sr.AudioFile(filename)
with audio_file as source:
audio_data = recognizer.record(source)
# Return the transcribed text
return recognizer.____(audio_data)
# Test the function
print(transcribe_audio(____))