การบันทึกเสียงในส่วนที่ต้องการ
บางครั้งเราอาจไม่ต้องการใช้ไฟล์เสียงทั้งหมด พารามิเตอร์ duration และ offset ของเมธอด record() จะช่วยในเรื่องนี้ได้
หลังจากสำรวจชุดข้อมูลแล้ว พบว่ามีไฟล์หนึ่งที่นำเข้ามาในชื่อ nothing_at_end ซึ่งมีความเงียบ 30 วินาทีที่ท้ายไฟล์ และไฟล์บันทึกการโทรหาฝ่ายสนับสนุนที่นำเข้ามาในชื่อ out_of_warranty ซึ่งมีสัญญาณรบกวน 3 วินาทีที่ต้นไฟล์
การกำหนดค่า duration และ offset จะทำให้เมธอด record() บันทึกเสียงตั้งแต่ตำแหน่ง offset เป็นระยะเวลาไม่เกิน duration โดยทั้งสองค่าวัดเป็นวินาที
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Spoken Language Processing ด้วย Python
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Convert AudioFile to AudioData
with nothing_at_end as source:
nothing_at_end_audio = recognizer.record(source,
duration=____,
offset=None)
# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
language="en-US")
print(text)