शुरू करेंमुफ़्त में शुरू करें

Mother's little helper (2)

कॉलम मिलाने का एक अधिक सामान्य तरीका यह है कि आप देखें कि उनके नामों में कहीं भी कोई वैल्यू आती है या नहीं (सिर्फ शुरुआत या अंत में नहीं). जैसा कि आप अंदाज़ा लगा सकते हैं, यह काम आप contains() नामक हेल्पर से कर सकते हैं.

और भी सामान्य रूप से, आप रेगुलर एक्सप्रेशन की मदद से कॉलम मिला सकते हैं. रेगुलर एक्सप्रेशन (संक्षेप में "regex") टेक्स्ट को मिलाने की एक ताकतवर भाषा है. यदि आप रेगुलर एक्सप्रेशन का उपयोग करना सीखना चाहते हैं, तो *String Manipulation with stringr in R * कोर्स देखें. फिलहाल, आपको तीन बातें ही जाननी हैं.

  1. a: कोई अक्षर लिखने का मतलब है "उसी अक्षर से मिलान करें".
  2. .: डॉट का मतलब है "किसी भी एक कैरेक्टर से मिलान करें, जैसे अक्षर, संख्या, विराम-चिह्न आदि".
  3. ?: प्रश्नचिह्न का मतलब है "पिछला कैरेक्टर वैकल्पिक है".

किसी खास regex से मेल खाने वाले कॉलम आप matches() सेलेक्ट हेल्पर का उपयोग करके पा सकते हैं.

यह अभ्यास पाठ्यक्रम का हिस्सा है

R में sparklyr के साथ Spark परिचय

पाठ्यक्रम देखें

अभ्यास निर्देश

आप के लिए spark_conn नाम की एक Spark कनेक्शन बनाई गई है. Spark में संग्रहीत ट्रैक मेटाडेटा से जुड़ी एक tibble पहले से track_metadata_tbl के रूप में परिभाषित है.

  • track_metadata_tbl से वे सभी कॉलम चुनें जिनमें "ti" शामिल हो.
  • track_metadata_tbl से वे सभी कॉलम चुनें जो रेगुलर एक्सप्रेशन "ti.?t" से मेल खाते हों.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# track_metadata_tbl has been pre-defined
track_metadata_tbl

track_metadata_tbl %>%
  # Select columns containing ti
  ___

track_metadata_tbl %>%
  # Select columns matching ti.?t
  ___
कोड संपादित करें और चलाएँ