शुरू करेंमुफ़्त में शुरू करें

PyDub के साथ स्टेरियो ऑडियो को मोनो में बाँटना

अगर आप फोन कॉल्स को ट्रांसक्राइब करने की कोशिश कर रहे हैं, तो संभव है कि वे स्टेरियो फ़ॉर्मैट में रिकॉर्ड किए गए हों, जहाँ हर चैनल पर एक-एक स्पीकर हो.

जैसा आपने देखा, एक से अधिक स्पीकर वाले ऑडियो फ़ाइल को ट्रांसक्राइब करना मुश्किल होता है. एक उपाय है कि कई स्पीकर्स वाली ऑडियो फ़ाइल को अलग-अलग स्पीकर्स वाले सिंगल फ़ाइलों में बाँट दिया जाए.

PyDub का split_to_mono() फंक्शन इसमें मदद करता है. जब आप इसे किसी स्टेरियो में रिकॉर्ड किए गए AudioSegment पर कॉल करते हैं, तो यह मोनो फ़ॉर्मैट में दो अलग-अलग AudioSegment की सूची लौटाता है, हर चैनल के लिए एक.

इस अभ्यास में, आप ऐसा करके देखेंगे: इस स्टेरियो फोन कॉल (stereo_phone_call.wav) रिकॉर्डिंग को channel 1 और channel 2 में बाँटें. इससे दोनों स्पीकर्स अलग हो जाएँगे, और ट्रांसक्रिप्शन आसान हो जाएगा.

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python में Spoken Language Processing

पाठ्यक्रम देखें

अभ्यास निर्देश

  • pydub से AudioSegment इम्पोर्ट करें.
  • stereo_phone_call.wav के साथ stereo_phone_call नाम का एक AudioSegment इंस्टेंस बनाएँ.
  • split_to_mono() का उपयोग करके stereo_phone_call को channels में बाँटें और आउटपुट के चैनल्स को जाँचें.
  • हर चैनल को नए वैरिएबल्स phone_call_channel_1 और phone_call_channel_2 में सेव करें.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Import AudioSegment
from ____ import ____

# Import stereo audio file and check channels
stereo_phone_call = AudioSegment.from_file(____)
print(f"Stereo number channels: {stereo_phone_call.channels}")

# Split stereo phone call and check channels
channels = stereo_phone_call.____
print(f"Split number channels: {channels[0].____}, {channels[1].____}")

# Save new channels separately
phone_call_channel_1 = channels[0]
phone_call_channel_2 = ____
कोड संपादित करें और चलाएँ