शुरू करेंमुफ़्त में शुरू करें

Start Requests से शुरुआत

पिछले लेसन में आपने scrapy स्पाइडर के अंदर start_requests मेथड सेटअप करना सीखा था। यहाँ आपके पास एक और टॉय-मॉडल स्पाइडर है जो वास्तव में कुछ स्क्रैप नहीं करता, लेकिन आपको start_requests मेथड के साथ अभ्यास करने का मौका देता है। हमारा उद्देश्य है कि आप start_requests के अंदर scrapy.Request कॉल में पास किए जाने वाले आर्ग्युमेंट्स से परिचित होना शुरू करें।

पहले की तरह, हमने inspect_class फंक्शन बनाया है ताकि वह जाँचे कि आप start_requests में क्या yield कर रहे हैं।

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python में Web Scraping

पाठ्यक्रम देखें

अभ्यास निर्देश

  • scrapy स्पाइडर बनाने के लिए क्लास YourSpider में आवश्यक scrapy ऑब्जेक्ट भरें।
  • start_requests मेथड के भीतर दिए गए scrapy.Request कॉल में खाली जगह भरें ताकि यह स्पाइडर जिस URL से स्क्रैपिंग शुरू करेगा वह "https://www.datacamp.com" हो, और वेबसाइट को पार्स करने के लिए (क्लास YourSpider के अंदर) parse मेथड का उपयोग किया जाए।

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Import scrapy library
import scrapy

# Create the spider class
class YourSpider( ____ ):
  name = "your_spider"
  # start_requests method
  def start_requests( self ):
    yield scrapy.Request( ____ )
  # parse method
  def parse( self, response ):
    pass
  
# Inspect Your Class
inspect_class( YourSpider )
कोड संपादित करें और चलाएँ