Start Requests로 시작하기
지난 레슨에서는 scrapy 스파이더 안에 start_requests 메서드를 설정하는 방법을 배웠어요. 여기 또 다른 장난감 예제 스파이더가 있는데, 실제로는 아무것도 스크레이프하지 않지만 start_requests 메서드를 연습해 볼 수 있어요. 목표는 start_requests 내부에서 scrapy.Request 호출에 전달하는 인수에 익숙해지는 것이에요.
이전과 마찬가지로, start_requests에서 여러분이 어떤 값을 yield하는지 확인하기 위해 inspect_class 함수를 만들어 두었어요.
이 연습은 강의의 일부입니다
Python으로 하는 웹 스크레이핑
연습 안내
scrapy스파이더를 생성하는 데 필요한 필수scrapy객체를 클래스YourSpider에 채워 넣으세요.start_requests메서드 안에서yield하는scrapy.Request호출의 빈칸을 채워, 이 스파이더가 시작할 URL이"https://www.datacamp.com"이 되도록 하고, 웹사이트를 파싱하는 메서드로 (YourSpider클래스의 )parse메서드를 사용하도록 하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Import scrapy library
import scrapy
# Create the spider class
class YourSpider( ____ ):
name = "your_spider"
# start_requests method
def start_requests( self ):
yield scrapy.Request( ____ )
# parse method
def parse( self, response ):
pass
# Inspect Your Class
inspect_class( YourSpider )