Výběr posledního potomka pomocí pseudo-třídy
V následujícím HTML kódu, který zobrazuje autora textu v posledním odstavci, jsou dvě skupiny uzlů p:
<html>
<body>
<div>
<p class = 'text'>A sophisticated text [...]</p>
<p class = 'text'>Another paragraph following [...]</p>
<p class = 'text'>Author: T.G.</p>
</div>
<p>Copyright: DC</p>
</body>
</html>
V tomto cvičení je tvým úkolem vybrat poslední uzel p uvnitř elementu div.
Jak ses naučil/a ve videu, pseudo-třídy se hodí vždy, když nemáš jiný způsob, jak vybrat konkrétní uzel stránky – například pomocí selektoru ID nebo unikátní třídy.
Výše uvedený HTML dokument máš k dispozici prostřednictvím proměnné nested_html (načtené pomocí read_html()).
Toto cvičení je součástí kurzu
Web Scraping v R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Select the last child of each p group
nested_html %>%
___