or
To ćwiczenie jest częścią kursu
Poznaj strukturę HTML. Zaczynamy od wyjaśnienia, dlaczego web scraping jest cennym uzupełnieniem zestawu narzędzi data science, a następnie omawiamy podstawy HTML. Rozdział kończy krótkie wprowadzenie do notacji XPath, która służy do nawigowania po elementach kodu HTML.
Wykorzystaj składnię XPath do eksploracji selektorów scrapy. Oba te zagadnienia przybliżą cię do samodzielnego scrapowania dokumentów HTML.
Poznaj składnię lokatorów CSS i zacznij łączyć je z XPath. Przedstawiamy też obiekty Response, które działają podobnie jak selektory, ale oferują dodatkowe narzędzia ułatwiające scrapowanie wielu stron jednocześnie.
Bieżące ćwiczenie
Naucz się tworzyć web crawlery przy użyciu scrapy. Te pająki scrapy będą przeszukiwać sieć, przechodząc przez kolejne strony i automatycznie scrapując każdą z nich zgodnie z technikami poznanymi w poprzednich rozdziałach.