or
Acest exercițiu face parte din cursul
Descoperă structura HTML. Începem prin a explica de ce web scraping-ul poate fi un instrument valoros în setul tău de instrumente pentru știința datelor, apoi aprofundăm noțiunile de bază ale HTML. Capitolul se încheie cu o scurtă introducere în notația XPath, folosită pentru a naviga prin elementele unui document HTML.
Exercițiul curent
Folosește sintaxa XPath pentru a explora selectorii scrapy. Ambele concepte te vor apropia de capacitatea de a face scraping pe un document HTML.
Învață sintaxa locatorilor CSS și începe să experimentezi cu înlănțuirea locatorilor CSS cu XPath. Introducem și obiectele Response, care se comportă similar cu selectorii, dar îți oferă instrumente suplimentare pentru a-ți extinde eforturile de scraping pe mai multe site-uri web.
Învață să creezi crawlere web cu scrapy. Aceste spidere scrapy vor parcurge web-ul prin mai multe pagini, urmând linkuri pentru a face scraping automat pe fiecare pagină, conform procedurilor învățate în capitolele anterioare.