Hyper(od)kaz v akci
Jedním z nejdůležitějších atributů při „procházení webu" je URL hypertextového odkazu (atribut href) uvnitř tagu a. V tomto cvičení takový odkaz extrahuješ! Funkce print_attribute je připravená k použití – vypíše data získaná z tvého XPath, takže si XPath řetězce můžeš vyzkoušet přímo v konzoli.
Cvičení se vztahuje k následujícímu HTML zdrojovému kódu:
<html>
<body>
<div id="div1" class="class-1">
<p class="class-1 class-2">Hello World!</p>
<div id="div2">
<p id="p2" class="class-2">Choose
<a href="http://datacamp.com">DataCamp!</a>!
</p>
</div>
</div>
<div id="div3" class="class-2">
<p class="class-2">Thanks for Watching!</p>
</div>
</body>
</html>
Toto cvičení je součástí kurzu
Web Scraping v Pythonu
Pokyny k cvičení
- Doplň prázdná místa a dokonči proměnnou
xpathníže tak, aby vybírala hodnotu atributuhrefz hypertextového odkazu na DataCamp.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Create an xpath to the href attribute
xpath = '//p[@id=____]/a/____'
# Print out the selection(s); there should be only one
print_attribute( xpath )