Zacznij terazZacznij za darmo

Scrapowanie elementu na podstawie jego tekstu

Jak pokazano w filmie, funkcja text() pozwala też wybierać elementy (i ich elementy nadrzędne) na podstawie ich treści. Oto lista uporządkowana:

<h3>The rules of programming</h3>
<ol>
  <li>Have <em>fun</em>.</li>
  <li><strong>Don't</strong> repeat yourself.</li>
  <li>Think <em>twice</em> when naming variables.</li>
</ol>

W tym ćwiczeniu twoim celem jest wyodrębnienie elementu li, w którym wyraz "twice" jest wyróżniony kursywą.

Możesz pomyśleć, że znacznie łatwiej byłoby tu zastosować selektor CSS, np. li:last-child – ale poczekaj, aż ukończysz to ćwiczenie…

programming_html zawiera powyższy dokument HTML.

To ćwiczenie jest częścią kursu

Web Scraping w R

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Select all li elements
programming_html %>%
	html_elements(___ = ___)
Edytuj i uruchom kod