or
이 연습은 강의의 일부입니다
HTML의 구조를 배웁니다. 먼저 웹 스크레이핑이 데이터 사이언스 도구 상자에 왜 유용한지 설명한 뒤, HTML의 기본을 살펴봅니다. 마지막에는 HTML 코드 내부 요소를 탐색하는 데 쓰이는 XPath 표기법을 간단히 소개합니다.
현재 연습
XPath 문법을 활용해 scrapy 셀렉터를 탐색해 보세요. 이 두 가지 개념은 HTML 문서를 스크레이핑할 수 있는 단계로 여러분을 이끌어 줍니다.
CSS 로케이터 문법을 배우고, CSS 로케이터를 XPath와 체이닝하는 아이디어를 실습해 봅니다. 또한 여러 웹사이트에 걸쳐 스크레이핑을 확장하는 데 유용한 추가 도구를 제공하면서 셀렉터처럼 동작하는 Response 객체를 소개합니다.
scrapy로 웹 크롤러를 만드는 방법을 배웁니다. 이 scrapy 스파이더는 이전 장에서 익힌 절차에 따라 링크를 따라가며 여러 페이지를 자동으로 크롤링합니다.