Kom igångKom igång gratis

Du har blivit `href`:ad

I en tidigare övning skapade du en CSS-lokaliseringssträng för att välja hyperlänksbarn (a-element) till alla div-element som tillhör klassen "course-block". Här har vi skapat en SelectorList kallad course_as som innehåller dessa hyperlänksbarn.

Nu vill vi att du fyller i tomrummet nedan för att extrahera href-attributvärdena från dessa element. Det här är ytterligare ett exempel på kedjning, som vi sett i en tidigare övning.

Poängen är att vi kan kedja anrop till metoderna css och xpath och kombinera dem! Vi hjälper dig i rätt riktning genom att ge dig lösningen om vi kedjar med ett ytterligare anrop till metoden css.

Den här övningen är en del av kursen

Webbskrapning i Python

Visa kurs

Övningsinstruktioner

  • Skapa Selector-objektet sel med strängen html som textinmatning.
  • Tilldela variabeln hrefs_from_xpath href-attributvärdena från elementen i course_as. Din lösning ska matcha hrefs_from_css!

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

from scrapy import Selector

# Create a selector object from a secret website
sel = Selector( ____ )

# Select all hyperlinks of div elements belonging to class "course-block"
course_as = sel.css( 'div.course-block > a' )

# Selecting all href attributes chaining with css
hrefs_from_css = course_as.css( '::attr(href)' )

# Selecting all href attributes chaining with xpath
hrefs_from_xpath = course_as.xpath( ____ )
Redigera och kör kod