शुरू करेंमुफ़्त में शुरू करें

grepl & grep (2)

आप कैरेट ^ और डॉलर साइन $ का उपयोग करके क्रमशः किसी स्ट्रिंग की शुरुआत और अंत पर मौजूद सामग्री से मैच कर सकते हैं. इससे हमें केवल हमारी ईमेल सूची में मौजूद ".edu" ईमेल पते मैच करने के लिए सही पैटर्न के एक कदम करीब ले जाया जा सकता है. लेकिन पैटर्न को और मजबूत बनाने के लिए कुछ और जोड़ा जा सकता है:

  • @, क्योंकि एक वैध ईमेल में at-sign होना ज़रूरी है.
  • .*, जो किसी भी कैरेक्टर (.) को शून्य या अधिक बार (*) मैच करता है. डॉट और एस्टरिस्क दोनों मेटा-कैरेक्टर हैं. आप इन्हें at-sign और ईमेल पते के ".edu" हिस्से के बीच आने वाले किसी भी कैरेक्टर को मैच करने के लिए उपयोग कर सकते हैं.
  • \\.edu$, स्ट्रिंग के अंत में ईमेल के ".edu" हिस्से से मैच करने के लिए. \\ भाग डॉट को escape करता है: यह R को बताता है कि आप . को एक वास्तविक कैरेक्टर की तरह उपयोग करना चाहते हैं.

यह अभ्यास पाठ्यक्रम का हिस्सा है

इंटरमीडिएट R

पाठ्यक्रम देखें

अभ्यास निर्देश

  • लॉजिकल वेक्टर लौटाने के लिए उन्नत रेगुलर एक्सप्रेशन के साथ grepl() का उपयोग करें. परिणाम को बस प्रिंट करें.
  • इसी तरह grep() का उपयोग करके इंडेक्स का एक वेक्टर बनाएँ. परिणाम को वैरिएबल hits में स्टोर करें.
  • emails[hits] का उपयोग करके emails वेक्टर को फिर से subset करें.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# The emails vector has already been defined for you
emails <- c("[email protected]", "[email protected]", "[email protected]",
            "invalid.edu", "[email protected]", "[email protected]")

# Use grepl() to match for .edu addresses more robustly


# Use grep() to match for .edu addresses more robustly, save result to hits


# Subset emails using hits
कोड संपादित करें और चलाएँ