शुरू करेंमुफ़्त में शुरू करें

PyDub के साथ किसी ऑडियो फ़ाइल को normalize करना

कभी-कभी आपके पास ऐसी ऑडियो फ़ाइलें होंगी जिनमें कुछ हिस्सों में आवाज़ तेज़ होती है और कुछ में धीमी. वॉल्यूम में यह उतार-चढ़ाव ट्रांसक्रिप्शन में बाधा बन सकता है.

अच्छी बात यह है कि PyDub के effects मॉड्यूल में normalize() नाम का एक फंक्शन है जो किसी AudioSegment की अधिकतम वॉल्यूम ढूँढता है, फिर बाकी AudioSegment को उसी अनुपात में समायोजित कर देता है. यानी धीमे हिस्सों का वॉल्यूम बढ़ जाएगा.

आप एक ऐसे ऑडियो फ़ाइल का उदाहरण सुन सकते हैं जो तेज़ से शुरू होकर बाद में धीमी हो जाती है, loud_then_quiet.wav, यहाँ.

इस अभ्यास में, आप normalize() का उपयोग करके हमारी फ़ाइल के वॉल्यूम को normalize करेंगे, ताकि यह कुछ इस तरह सुनाई दे.

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python में Spoken Language Processing

पाठ्यक्रम देखें

अभ्यास निर्देश

  • PyDub से AudioSegment और PyDub के effects मॉड्यूल से normalize इम्पोर्ट करें.
  • टारगेट ऑडियो फ़ाइल loud_then_quiet.wav इम्पोर्ट करें और इसे loud_then_quiet में सेव करें.
  • इम्पोर्ट की गई ऑडियो फ़ाइल को normalize() फंक्शन का उपयोग करके normalize करें और इसे normalized_loud_then_quiet में सेव करें.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Import AudioSegment and normalize
from pydub import ____
from pydub.effects import ____

# Import target audio file
loud_then_quiet = AudioSegment.from_file(____)

# Normalize target audio file
normalized_loud_then_quiet = ____(____)
कोड संपादित करें और चलाएँ