शुरू करेंमुफ़्त में शुरू करें

AudioFile से AudioData तक

जैसा आपने पहले देखा, ऑडियो डेटा को उपयोगी बनाने के लिए कुछ transformation स्टेप्स करने पड़ते हैं. SpeechRecognition पर भी यही लागू होता है.

इस अभ्यास में, हम clean_support_call.wav audio file इम्पोर्ट करेंगे और उसे recognition के लिए तैयार करेंगे.

हम पहले AudioFile क्लास का उपयोग करके अपनी ऑडियो फ़ाइल पढ़ते हैं. लेकिन recognize_google() मेथड को AudioData टाइप का इनपुट चाहिए.

अपने AudioFile को AudioData में बदलने के लिए, हम Recognizer क्लास के record() मेथड का उपयोग एक context manager के साथ करेंगे. record() मेथड एक AudioFile इनपुट लेता है और उसे AudioData में बदल देता है, जिसे recognize_google() के साथ सीधे इस्तेमाल किया जा सकता है.

SpeechRecognition पहले से ही sr नाम से इम्पोर्ट किया गया है.

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python में Spoken Language Processing

पाठ्यक्रम देखें

अभ्यास निर्देश

  • AudioFile क्लास को clean_support_call.wav पास करें.
  • Context manager का उपयोग करके clean_support_call को source के रूप में खोलें और पढ़ें.
  • source को रिकॉर्ड करें और कोड चलाएँ.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
कोड संपादित करें और चलाएँ