Scrapowanie elementu na podstawie jego tekstu
Jak pokazano w filmie, funkcja text() pozwala też wybierać elementy (i ich elementy nadrzędne) na podstawie ich treści. Oto lista uporządkowana:
<h3>The rules of programming</h3>
<ol>
<li>Have <em>fun</em>.</li>
<li><strong>Don't</strong> repeat yourself.</li>
<li>Think <em>twice</em> when naming variables.</li>
</ol>
W tym ćwiczeniu twoim celem jest wyodrębnienie elementu li, w którym wyraz "twice" jest wyróżniony kursywą.
Możesz pomyśleć, że znacznie łatwiej byłoby tu zastosować selektor CSS, np. li:last-child – ale poczekaj, aż ukończysz to ćwiczenie…
programming_html zawiera powyższy dokument HTML.
To ćwiczenie jest częścią kursu
Web Scraping w R
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Select all li elements
programming_html %>%
html_elements(___ = ___)