शुरू करेंमुफ़्त में शुरू करें

spaCy में एकल टर्म का मिलान

RegEx पैटर्न पढ़ना, लिखना और debug करना आसान नहीं होता. लेकिन आपके पास विकल्प है: spaCy एक readable और production-level विकल्प देता है, यानी Matcher क्लास. Matcher क्लास, दिए गए Doc कंटेनर में टोकन्स के क्रम पर predefined नियमों का मिलान कर सकता है. इस अभ्यास में, आप एक अकेले शब्द को ढूँढने के लिए Matcher का इस्तेमाल करना सीखेंगे.

आप example_text में संबंधित टेक्स्ट तक पहुँच सकते हैं और क्रमशः spaCy मॉडल और example_text के Doc कंटेनर तक पहुँचने के लिए nlp और doc का उपयोग कर सकते हैं.

यह अभ्यास पाठ्यक्रम का हिस्सा है

spaCy के साथ Natural Language Processing

पाठ्यक्रम देखें

अभ्यास निर्देश

  • Matcher क्लास को initialize करें.
  • example_text में lower case वाले witch से मेल खाने के लिए एक पैटर्न परिभाषित करें.
  • पैटर्न्स को Matcher क्लास में जोड़ें और matches खोजें.
  • matches पर iterate करें और matched टेक्स्ट के start और end टोकन इंडेक्स तथा span को प्रिंट करें.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

nlp = spacy.load("en_core_web_sm")
doc = nlp(example_text)

# Initialize a Matcher object
matcher = Matcher(nlp.____)

# Define a pattern to match lower cased word witch
pattern = [{"lower" : ____}]

# Add the pattern to matcher object and find matches
matcher.add("CustomMatcher", [____])
matches = matcher(____)

# Print start and end token indices and span of the matched text
for match_id, start, end in matches:
    print("Start token: ", ____, " | End token: ", ____, "| Matched text: ", doc[____:____].text)
कोड संपादित करें और चलाएँ