or
Den här övningen är en del av kursen
Lär dig HTML-strukturens uppbyggnad. Vi börjar med att förklara varför webbskrapning kan vara ett värdefullt tillskott i din datavetenskap och går sedan igenom grunderna i HTML. Kapitlet avslutas med en kort introduktion till XPath-notation, som används för att navigera bland element i HTML-kod.
Använd XPath-syntax för att utforska scrapy-selektorer. Båda dessa begrepp tar dig ett steg närmare att kunna skrapa ett HTML-dokument.
Aktuell övning
Lär dig CSS-lokaliserarsyntax och börja experimentera med att kedja ihop CSS-lokaliserare med XPath. Vi introducerar även Response-objekt, som fungerar som selektorer men erbjuder extra verktyg för att sprida dina skrapningsinsatser över flera webbplatser.
Lär dig att skapa webbsökare med scrapy. Dessa scrapy-spindlar genomsöker webben över flera sidor, följer länkar och skrapar varje sida automatiskt enligt de metoder du lärt dig i tidigare kapitel.