सभी कैप्चरिंग ग्रुप्स को मैच करें
इस अभ्यास में, आप top_10 नाम की एक टेक्स्ट फाइल के साथ काम करेंगे जिसमें मूवी के नाम और उनकी रैंक स्टोर हैं। इस मल्टी-लाइन टेक्स्ट में नई लाइन शुरू करने के लिए \\n का उपयोग हुआ है। आप str_split() फंक्शन का उपयोग करके टेक्स्ट फाइल को कई लाइनों में स्प्लिट करेंगे।
नई बनी एक-पंक्ति वाली मैट्रिक्स top_10_lines में फिर एक ही पैटर्न वाली दस लाइनें होंगी: मूवी की रैंक, उसके बाद एक डॉट और एक स्पेस, और फिर मूवी का टाइटल। फंक्शन str_match() और दो कैप्चरिंग ग्रुप्स () की मदद से आप इन दो सूचनाओं को plain text से निकालकर टैब्युलर फॉर्म में ला पाएँगे।
यह अभ्यास पाठ्यक्रम का हिस्सा है
R में Intermediate Regular Expressions
अभ्यास निर्देश
str_split()फंक्शन का उपयोग करके टेक्स्ट को उसकी लाइनों में स्प्लिट करें, औरsimplifyसक्षम करके आउटपुट एक कैरेक्टर मैट्रिक्स के रूप में पाएँ।- एक लाइन की संरचना को समझिए। इसमें किसी मूवी की रैंक और टाइटल होता है।
str_match()फंक्शन में कैप्चरिंग ग्रुप्स का उपयोग करके किसी मूवी की रैंक और टाइटल एक्सट्रैक्ट करें।
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Split the input by line break and enable simplify
top_10_lines <- str_split(
top_10,
pattern = "___",
simplify = ___
)
# Inspect the first three lines and analyze their form
___[1:3]
# Add to the pattern two capturing groups that match rank and title
str_match(
top_10_lines,
pattern = "___\\. ___"
)