Zacznij terazZacznij za darmo

Zrób to po httr-owemu

Oto kod rvest, którego użyłem(-am), żeby sprawdzić wysokość nad poziomem morza pewnego pięknego miejsca, w którym niedawno spędziłem(-am) wakacje.

# Get the HTML document from Wikipedia
wikipedia_page <- read_html('https://en.wikipedia.org/wiki/Varigotti')
# Parse the document and extract the elevation from it
wikipedia_page %>% 
  html_elements('table tr:nth-child(9) > td') %>% 
  html_text()

Jak pokazano w materiale wideo, read_html() wysyła w rzeczywistości żądanie HTTP GET, gdy podasz mu adres URL – tak jak w tym przypadku.

Celem tego ćwiczenia jest odtworzenie tego samego zapytania bez read_html(), ale z użyciem metod z pakietu httr.

Uwaga: na co dzień rvest w zupełności wystarcza, ale jeśli chcesz dostosowywać żądania – czego nauczysz się w dalszej części tego rozdziału – musisz poznać sposób działania httr.

Dla utrwalenia wiedzy przetłumaczysz też selektor CSS użyty w html_elements() na zapytanie XPATH.

To ćwiczenie jest częścią kursu

Web Scraping w R

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Get the HTML document from Wikipedia using httr
wikipedia_response <- ___('https://en.wikipedia.org/wiki/Varigotti')
# Parse the response into an HTML doc
wikipedia_page <- ___(___)
Edytuj i uruchom kod