Наследование спайдера
Изучая спайдеры scrapy, мы выяснили, что основная часть кода, которую нам нужно настраивать, — это class спайдера. Чтобы лучше разобраться в устройстве класса, вам предстоит дописать небольшой фрагмент кода, который имитирует структуру класса спайдера. Мы убрали код, непосредственно запускающий спайдер, и оставили только то, что необходимо для создания класса.
Как упоминалось в уроке, class — это, по сути, набор связанных переменных и функций, объединённых вместе. Иногда один класс использует методы другого класса — в таком случае говорят, что он наследует эти методы. Именно так устроен класс спайдера.
Мы написали функцию inspect_class, которая позволяет проверить ваш класс после завершения работы — воспользуйтесь ею, чтобы протестировать своё решение!
Это упражнение является частью курса
Веб-скрапинг на Python
Инструкции к упражнению
- Передайте
scrapy.Spiderв качестве аргумента классуYourSpider— это позволитYourSpiderунаследовать методы изscrapy.Spider.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Import scrapy library
import scrapy
# Create the spider class
class YourSpider(____):
name = "your_spider"
# start_requests method
def start_requests(self):
pass
# parse method
def parse(self, response):
pass
# Inspect Your Class
inspect_class(YourSpider)