Selectează ultimul copil cu o pseudo-clasă
În următorul HTML, care afișează autorul unui text în ultimul paragraf, există două grupuri de noduri p:
<html>
<body>
<div>
<p class = 'text'>A sophisticated text [...]</p>
<p class = 'text'>Another paragraph following [...]</p>
<p class = 'text'>Author: T.G.</p>
</div>
<p>Copyright: DC</p>
</body>
</html>
În acest exercițiu, sarcina ta este să selectezi ultimul nod p din interiorul div-ului.
Așa cum ai văzut în video, pseudo-clasele sunt utile atunci când nu ai alte modalități de a selecta un nod specific din pagină – de exemplu, printr-un selector de ID sau o clasă unică.
Documentul HTML de mai sus îți este pus la dispoziție prin variabila nested_html (deja citită cu read_html()).
Acest exercițiu face parte din cursul
Web Scraping în R
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Select the last child of each p group
nested_html %>%
___