เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

พารามิเตอร์ของไฟล์เสียงด้วย PyDub

ไฟล์เสียงแต่ละไฟล์ที่ใช้งานจะมีคุณลักษณะต่าง ๆ ที่เกี่ยวข้อง เช่น จำนวนช่องสัญญาณ (channels) เฟรมเรต (frame rate หรือ sample rate) ความกว้างของตัวอย่าง (sample width) และอื่น ๆ

การทราบพารามิเตอร์เหล่านี้มีประโยชน์ในการตรวจสอบว่าไฟล์เสียงของเราสอดคล้องกับข้อกำหนดของ API ต่าง ๆ สำหรับการถอดความเสียง

ตัวอย่างเช่น หลาย API แนะนำให้ใช้เฟรมเรตขั้นต่ำ (wav_file.frame_rate) ที่ 16,000 Hz

เมื่อสร้าง instance ของ AudioSegment PyDub จะดึงพารามิเตอร์เหล่านี้จากไฟล์เสียงโดยอัตโนมัติ และบันทึกเป็น attribute ไว้ให้

ในแบบฝึกหัดนี้ เราจะสำรวจ attribute เหล่านั้นกัน

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

Spoken Language Processing ด้วย Python

ดูคอร์ส

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")

# Find the frame rate
print(wav_file.____)
แก้ไขและรันโค้ด