Byl/a jsi `href`ován/a
V předchozím cvičení jsi vytvořil/a řetězec CSS lokátoru pro výběr podřízených hypertextových odkazů (elementů a) všech elementů div patřících do třídy "course-block". Tady jsme pro tebe vytvořili SelectorList s názvem course_as, který tyto podřízené prvky odkazů obsahuje.
Tvým úkolem je doplnit chybějící část níže tak, aby se z těchto elementů extrahovaly hodnoty atributu href. Jde o další ukázku řetězení, které jsme viděli v předchozím cvičení.
Pointa je v tom, že metody css a xpath lze volat za sebou a kombinovat! Správný směr ti naznačíme tím, že ti ukážeme řešení pomocí dalšího volání metody css.
Toto cvičení je součástí kurzu
Web Scraping v Pythonu
Pokyny k cvičení
- Vytvoř objekt
Selectors názvemselpomocí řetězcehtmljako textového vstupu. - Přiřaď proměnné
hrefs_from_xpathhodnoty atributuhrefz elementů vcourse_as. Tvoje řešení by mělo odpovídat hodnotěhrefs_from_css!
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
from scrapy import Selector
# Create a selector object from a secret website
sel = Selector( ____ )
# Select all hyperlinks of div elements belonging to class "course-block"
course_as = sel.css( 'div.course-block > a' )
# Selecting all href attributes chaining with css
hrefs_from_css = course_as.css( '::attr(href)' )
# Selecting all href attributes chaining with xpath
hrefs_from_xpath = course_as.xpath( ____ )