เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

กระบวนการประมวลผลไฟล์เสียง

เราได้เรียนรู้วิธีนำเข้าและจัดการไฟล์เสียงไฟล์เดียวด้วย PyDub แล้ว แต่ถ้ามีโฟลเดอร์ที่มีไฟล์เสียงหลายไฟล์ที่ต้องการแปลงล่ะ?

ในแบบฝึกหัดนี้ เราจะใช้ PyDub เพื่อจัดรูปแบบไฟล์ในโฟลเดอร์ให้พร้อมใช้งานกับ speech_recognition

ไฟล์บันทึกการโทรของลูกค้าทุกไฟล์มีเสียงสัญญาณรบกวน 3 วินาทีที่ต้นไฟล์ และมีระดับเสียงที่ค่อนข้างเบา

เพื่อแก้ปัญหานี้ เราจะใช้ PyDub เพื่อตัดเสียงสัญญาณรบกวนออก เพิ่มระดับเสียง และแปลงไฟล์ให้เป็นนามสกุล .wav

ฟังตัวอย่างไฟล์ที่ยังไม่ได้จัดรูปแบบได้ ที่นี่

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

Spoken Language Processing ด้วย Python

ดูคอร์ส

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
แก้ไขและรันโค้ด