พารามิเตอร์ของไฟล์เสียงด้วย PyDub
ไฟล์เสียงแต่ละไฟล์ที่ใช้งานจะมีคุณลักษณะต่าง ๆ ที่เกี่ยวข้อง เช่น จำนวนช่องสัญญาณ (channels) เฟรมเรต (frame rate หรือ sample rate) ความกว้างของตัวอย่าง (sample width) และอื่น ๆ
การทราบพารามิเตอร์เหล่านี้มีประโยชน์ในการตรวจสอบว่าไฟล์เสียงของเราสอดคล้องกับข้อกำหนดของ API ต่าง ๆ สำหรับการถอดความเสียง
ตัวอย่างเช่น หลาย API แนะนำให้ใช้เฟรมเรตขั้นต่ำ (wav_file.frame_rate) ที่ 16,000 Hz
เมื่อสร้าง instance ของ AudioSegment PyDub จะดึงพารามิเตอร์เหล่านี้จากไฟล์เสียงโดยอัตโนมัติ และบันทึกเป็น attribute ไว้ให้
ในแบบฝึกหัดนี้ เราจะสำรวจ attribute เหล่านั้นกัน
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Spoken Language Processing ด้วย Python
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")
# Find the frame rate
print(wav_file.____)