Multiple Speakers 1
अगर आपका लक्ष्य बातचीतों को ट्रांसक्राइब करना है, तो वहाँ एक से अधिक स्पीकर होंगे. हालाँकि, जैसा आप देखेंगे, recognize_google() फंक्शन स्पीच को सिर्फ एक ही टेक्स्ट ब्लॉक में ट्रांसक्राइब करता है.
आप इस ऑडियो फ़ाइल में सुन सकते हैं कि तीन अलग-अलग स्पीकर हैं.
लेकिन अगर आप इसे सीधे ट्रांसक्राइब करते हैं, तो recognize_google() एक ही टेक्स्ट ब्लॉक लौटाता है. यह उपयोगी तो है, लेकिन इससे आपको यह नहीं पता चलता कि किस स्पीकर ने क्या कहा.
हम अगले अभ्यास में इसका एक वैकल्पिक तरीका देखेंगे.
मल्टिपल स्पीकर्स की ऑडियो फ़ाइल इंपोर्ट करके AudioData में कन्वर्ट की जा चुकी है और multiple_speakers नाम दिया गया है.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Spoken Language Processing
अभ्यास निर्देश
Recognizerका एक इंस्टेंस बनाएँ.recognize_google()फंक्शन का उपयोग करकेmultiple_speakersवैरिएबल को रिकग्नाइज़ करें.- भाषा US English (
"en-US") सेट करें.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)