शुरू करेंमुफ़्त में शुरू करें

Safe iterations

पिछले अध्याय की तरह, मान लीजिए कि आप एक वेब एजेंसी में काम करने वाले डेटा एनालिस्ट हैं. इस बार आपसे वेब स्क्रैपिंग करने के लिए कहा गया है.

(नोट: अगर आपको वेब स्क्रैपिंग नहीं आती, तो घबराइए नहीं. हम सरल से शुरू करेंगे और सभी फंक्शनों की व्याख्या की जाएगी.)

आपको URLs की एक सूची मिली है, लेकिन आपको शक है कि इनमें से कुछ असली पते नहीं हैं. सबसे पहले आप यह जाँचेंगे कि क्या आप इन URLs से कनेक्ट कर सकते हैं. इसके लिए, हम readr पैकेज का एक सरल फंक्शन इस्तेमाल करेंगे: read_lines(), जिसे हम safely() के अंदर रखेंगे. जब इसे कोई URL दिया जाता है, तो read_lines() HTML पढ़ता है, या अगर URL पहुँच योग्य नहीं है तो एक error लौटाता है.

urls वेक्टर आपके कार्यक्षेत्र में उपलब्ध है. अगर आप देखना चाहें कि इसमें क्या है, तो इसे कंसोल में प्रिंट कीजिए.

यह अभ्यास पाठ्यक्रम का हिस्सा है

इंटरमीडिएट फ़ंक्शनल प्रोग्रामिंग विथ purrr

पाठ्यक्रम देखें

अभ्यास निर्देश

  • read_lines() फंक्शन का एक सुरक्षित संस्करण बनाइए.

  • इस नए बनाए गए फंक्शन को दिए गए urls नामक वेक्टर पर map कीजिए.

  • परिणामों के नाम set_names() फंक्शन से सेट कीजिए.

  • हर sublist के "error" एलिमेंट को निकालिए.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Create a safe version of read_lines()
safe_read <- ___(___)

# Map it on the urls vector
res <- ___(urls, ___)

# Set the name of the results to `urls`
named_res <- ___(res, ___)

# Extract only the "error" part of each sublist
___(named_res, ___)
कोड संपादित करें और चलाएँ