शुरू करेंमुफ़्त में शुरू करें

सभी कैप्चरिंग ग्रुप्स को मैच करें

इस अभ्यास में, आप top_10 नाम की एक टेक्स्ट फाइल के साथ काम करेंगे जिसमें मूवी के नाम और उनकी रैंक स्टोर हैं। इस मल्टी-लाइन टेक्स्ट में नई लाइन शुरू करने के लिए \\n का उपयोग हुआ है। आप str_split() फंक्शन का उपयोग करके टेक्स्ट फाइल को कई लाइनों में स्प्लिट करेंगे।

नई बनी एक-पंक्ति वाली मैट्रिक्स top_10_lines में फिर एक ही पैटर्न वाली दस लाइनें होंगी: मूवी की रैंक, उसके बाद एक डॉट और एक स्पेस, और फिर मूवी का टाइटल। फंक्शन str_match() और दो कैप्चरिंग ग्रुप्स () की मदद से आप इन दो सूचनाओं को plain text से निकालकर टैब्युलर फॉर्म में ला पाएँगे।

यह अभ्यास पाठ्यक्रम का हिस्सा है

R में Intermediate Regular Expressions

पाठ्यक्रम देखें

अभ्यास निर्देश

  • str_split() फंक्शन का उपयोग करके टेक्स्ट को उसकी लाइनों में स्प्लिट करें, और simplify सक्षम करके आउटपुट एक कैरेक्टर मैट्रिक्स के रूप में पाएँ।
  • एक लाइन की संरचना को समझिए। इसमें किसी मूवी की रैंक और टाइटल होता है।
  • str_match() फंक्शन में कैप्चरिंग ग्रुप्स का उपयोग करके किसी मूवी की रैंक और टाइटल एक्सट्रैक्ट करें।

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Split the input by line break and enable simplify
top_10_lines <- str_split(
  top_10,
  pattern = "___",
  simplify = ___
)

# Inspect the first three lines and analyze their form
___[1:3]

# Add to the pattern two capturing groups that match rank and title
str_match(
  top_10_lines,
  pattern = "___\\. ___"
)
कोड संपादित करें और चलाएँ