Začněte nyníZačněte zdarma

Byl/a jsi `href`ován/a

V předchozím cvičení jsi vytvořil/a řetězec CSS lokátoru pro výběr podřízených hypertextových odkazů (elementů a) všech elementů div patřících do třídy "course-block". Tady jsme pro tebe vytvořili SelectorList s názvem course_as, který tyto podřízené prvky odkazů obsahuje.

Tvým úkolem je doplnit chybějící část níže tak, aby se z těchto elementů extrahovaly hodnoty atributu href. Jde o další ukázku řetězení, které jsme viděli v předchozím cvičení.

Pointa je v tom, že metody css a xpath lze volat za sebou a kombinovat! Správný směr ti naznačíme tím, že ti ukážeme řešení pomocí dalšího volání metody css.

Toto cvičení je součástí kurzu

Web Scraping v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Vytvoř objekt Selector s názvem sel pomocí řetězce html jako textového vstupu.
  • Přiřaď proměnné hrefs_from_xpath hodnoty atributu href z elementů v course_as. Tvoje řešení by mělo odpovídat hodnotě hrefs_from_css!

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

from scrapy import Selector

# Create a selector object from a secret website
sel = Selector( ____ )

# Select all hyperlinks of div elements belonging to class "course-block"
course_as = sel.css( 'div.course-block > a' )

# Selecting all href attributes chaining with css
hrefs_from_css = course_as.css( '::attr(href)' )

# Selecting all href attributes chaining with xpath
hrefs_from_xpath = course_as.xpath( ____ )
Upravit a spustit kód