Start Requests से शुरुआत
पिछले लेसन में आपने scrapy स्पाइडर के अंदर start_requests मेथड सेटअप करना सीखा था। यहाँ आपके पास एक और टॉय-मॉडल स्पाइडर है जो वास्तव में कुछ स्क्रैप नहीं करता, लेकिन आपको start_requests मेथड के साथ अभ्यास करने का मौका देता है। हमारा उद्देश्य है कि आप start_requests के अंदर scrapy.Request कॉल में पास किए जाने वाले आर्ग्युमेंट्स से परिचित होना शुरू करें।
पहले की तरह, हमने inspect_class फंक्शन बनाया है ताकि वह जाँचे कि आप start_requests में क्या yield कर रहे हैं।
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Web Scraping
अभ्यास निर्देश
scrapyस्पाइडर बनाने के लिए क्लासYourSpiderमें आवश्यकscrapyऑब्जेक्ट भरें।start_requestsमेथड के भीतर दिए गएscrapy.Requestकॉल में खाली जगह भरें ताकि यह स्पाइडर जिस URL से स्क्रैपिंग शुरू करेगा वह"https://www.datacamp.com"हो, और वेबसाइट को पार्स करने के लिए (क्लासYourSpiderके अंदर)parseमेथड का उपयोग किया जाए।
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Import scrapy library
import scrapy
# Create the spider class
class YourSpider( ____ ):
name = "your_spider"
# start_requests method
def start_requests( self ):
yield scrapy.Request( ____ )
# parse method
def parse( self, response ):
pass
# Inspect Your Class
inspect_class( YourSpider )