सभी स्तर का टेक्स्ट
यह अभ्यास पिछले वाले जैसा है, लेकिन फर्क यह है कि यहाँ आप किसी दिए गए एलिमेंट की कई पीढ़ियों से टेक्स्ट चुनेंगे.
आप एक XPath और CSS Locator स्ट्रिंग लिखेंगे जो किसी विशेष पैराग्राफ p एलिमेंट के टेक्स्ट तक पहुँचाएँ. HTML में यह p एलिमेंट उसके id एट्रिब्यूट से uniquely परिभाषित है, जो "p3" है. इस छोटी-सी जानकारी से आप वांछित स्ट्रिंग्स बना सकेंगे; फिर भी, हमने वैरिएबल html में वह HTML स्ट्रिंग प्रीलोड कर दी है जिसमें यह लिंक आता है, अगर आप उसे देखना चाहें.
इस अभ्यास में, आप केवल उस एलिमेंट के अंदर का टेक्स्ट चुनेंगे जो भविष्य की सभी पीढ़ियों के भीतर का टेक्स्ट भी शामिल करता है. तुलना करने के लिए कि आपकी स्ट्रिंग्स किन एलिमेंट्स की ओर इशारा करती हैं, हमने आपके लिए print_results फंक्शन बना दिया है.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Web Scraping
अभ्यास निर्देश
- वैरिएबल
xpathको ऐसी XPath स्ट्रिंग असाइन करें जोidबराबरp3वाले पैराग्राफpएलिमेंट के भीतर के टेक्स्ट की ओर इशारा करे, और इसpएलिमेंट की भविष्य की पीढ़ियों का टेक्स्ट भी शामिल करे. - वैरिएबल
css_locatorको ऐसी CSS Locator स्ट्रिंग असाइन करें जो इसी टेक्स्ट की ओर इशारा करे.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Create an XPath string to the desired text.
xpath = ____
# Create a CSS Locator string to the desired text.
css_locator = ____
# Print the text from our selections
print_results( xpath, css_locator )