शीर्ष-स्तरीय टेक्स्ट
इस अभ्यास में आप एक XPath और CSS Locator स्ट्रिंग लिखेंगे जो एक विशेष पैराग्राफ p एलिमेंट के टेक्स्ट तक पहुँचाए. HTML में यह p एलिमेंट अपने id एट्रिब्यूट से uniquely परिभाषित है, जो "p3" है. इस छोटी-सी जानकारी के आधार पर, आप वांछित स्ट्रिंग्स बना पाएँगे; हालाँकि, यदि आप उसे देखना चाहें, तो हमने वैरिएबल html में उस HTML की स्ट्रिंग प्रीलोड कर दी है जिसमें यह लिंक आता है.
इस अभ्यास में, आप केवल उसी एलिमेंट के भीतर का टेक्स्ट चुनेंगे, जिसमें उस एलिमेंट की आगे की पीढ़ियों का टेक्स्ट शामिल नहीं है. तुलना करने के लिए कि आपकी स्ट्रिंग्स किन एलिमेंट्स की ओर इशारा कर रही हैं, हमने आपके लिए print_results नाम का एक फंक्शन बनाया है.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Web Scraping
अभ्यास निर्देश
- वैरिएबल
xpathको ऐसी XPath स्ट्रिंग असाइन करें जोidp3वाले पैराग्राफpएलिमेंट के भीतर के टेक्स्ट तक निर्देशित करे, जिसमें इसpएलिमेंट की आगे की पीढ़ियों का टेक्स्ट शामिल नहीं हो. - वैरिएबल
css_locatorको ऐसी CSS Locator स्ट्रिंग असाइन करें जो इसी टेक्स्ट तक निर्देशित करे.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Create an XPath string to the desired text.
xpath = ____
# Create a CSS Locator string to the desired text.
css_locator = ____
# Print the text from our selections
print_results( xpath, css_locator )