เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

การบันทึกเสียงในส่วนที่ต้องการ

บางครั้งเราอาจไม่ต้องการใช้ไฟล์เสียงทั้งหมด พารามิเตอร์ duration และ offset ของเมธอด record() จะช่วยในเรื่องนี้ได้

หลังจากสำรวจชุดข้อมูลแล้ว พบว่ามีไฟล์หนึ่งที่นำเข้ามาในชื่อ nothing_at_end ซึ่งมีความเงียบ 30 วินาทีที่ท้ายไฟล์ และไฟล์บันทึกการโทรหาฝ่ายสนับสนุนที่นำเข้ามาในชื่อ out_of_warranty ซึ่งมีสัญญาณรบกวน 3 วินาทีที่ต้นไฟล์

การกำหนดค่า duration และ offset จะทำให้เมธอด record() บันทึกเสียงตั้งแต่ตำแหน่ง offset เป็นระยะเวลาไม่เกิน duration โดยทั้งสองค่าวัดเป็นวินาที

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

Spoken Language Processing ด้วย Python

ดูคอร์ส

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Convert AudioFile to AudioData
with nothing_at_end as source:
    nothing_at_end_audio = recognizer.record(source,
                                             duration=____,
                                             offset=None)

# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
                                   language="en-US")

print(text)
แก้ไขและรันโค้ด