กระบวนการประมวลผลไฟล์เสียง
เราได้เรียนรู้วิธีนำเข้าและจัดการไฟล์เสียงไฟล์เดียวด้วย PyDub แล้ว แต่ถ้ามีโฟลเดอร์ที่มีไฟล์เสียงหลายไฟล์ที่ต้องการแปลงล่ะ?
ในแบบฝึกหัดนี้ เราจะใช้ PyDub เพื่อจัดรูปแบบไฟล์ในโฟลเดอร์ให้พร้อมใช้งานกับ speech_recognition
ไฟล์บันทึกการโทรของลูกค้าทุกไฟล์มีเสียงสัญญาณรบกวน 3 วินาทีที่ต้นไฟล์ และมีระดับเสียงที่ค่อนข้างเบา
เพื่อแก้ปัญหานี้ เราจะใช้ PyDub เพื่อตัดเสียงสัญญาณรบกวนออก เพิ่มระดับเสียง และแปลงไฟล์ให้เป็นนามสกุล .wav
ฟังตัวอย่างไฟล์ที่ยังไม่ได้จัดรูปแบบได้ ที่นี่
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Spoken Language Processing ด้วย Python
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
file_with_static = AudioSegment.from_file(____)
# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]