एक ऑडियो प्रोसेसिंग वर्कफ़्लो
आपने देखा कि PyDub का इस्तेमाल करके एक सिंगल ऑडियो फ़ाइल को कैसे इम्पोर्ट और मैनिप्युलेट किया जाता है। लेकिन अगर आपके पास कई ऑडियो फ़ाइलों वाला एक फ़ोल्डर हो जिसे कन्वर्ट करना हो, तो क्या करेंगे?
इस अभ्यास में हम PyDub का उपयोग करके फ़ोल्डर की फ़ाइलों को इस तरह फॉर्मैट करेंगे कि वे speech_recognition के साथ इस्तेमाल करने के लिए तैयार हों।
आपने पाया कि आपकी कस्टमर कॉल फ़ाइलों की शुरुआत में 3 सेकंड का स्टैटिक नॉइज़ है और उनकी वॉल्यूम जरूरत से कम है।
इसे ठीक करने के लिए, हम PyDub से स्टैटिक को काटेंगे, साउंड लेवल बढ़ाएँगे, और उन्हें .wav एक्सटेंशन में कन्वर्ट करेंगे।
आप बिना फॉर्मैट किया गया एक उदाहरण यहाँ सुन सकते हैं।
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Spoken Language Processing
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
file_with_static = AudioSegment.from_file(____)
# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]