Začněte nyníZačněte zdarma

Výběr podle třídy a ID pomocí XPATH

Tady je HTML kód podobný tomu, se kterým ses setkal/a v předchozí kapitole (už načtený do HTML dokumentu weather_html):

<html>
  <body>
    <div id = 'first'>
      <h1 class = 'big'>Berlin Weather Station</h1>
      <p class = 'first'>Temperature: 20°C</p>
      <p class = 'second'>Humidity: 45%</p>
    </div>
    <div id = 'second'>...</div>
    <div id = 'third'>
      <p class = 'first'>Sunshine: 5hrs</p>
      <p class = 'second'>Precipitation: 0mm</p>
    </div>
  </body>
</html>

V této kapitole kód vypadá trochu víc jako v reálném světě. Tvým cílem je z tohoto meteorologického záznamu vytáhnout hodnotu srážek. Bohužel na ni nelze přímo odkazovat přes ID.

Postupujeme krok za krokem – nejprve si připravíme jednotlivé stavební bloky a pak je spojíme dohromady!

Toto cvičení je součástí kurzu

Web Scraping v R

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Select all p elements
weather_html %>%
	html_elements(xpath = '___')
Upravit a spustit kód