Zacznij terazZacznij za darmo

Zliczanie polubionych tweetów

Kontynuujmy eksplorację zbioru danych RStudio Conf. Przypomnij sobie, że jest to lista ponad 5000 podlist – każda z nich reprezentuje tweet zawierający hashtag #RStudioConf.

W tym ćwiczeniu wyodrębnimy statystykę dotyczącą tweetów, które nie były retweetami: średnią liczbę polubień. Element "favorite_count" zawarty w każdej podliście to liczba osób, które polubiły dany tweet.

Biblioteka purrr jest już załadowana, a zbiór danych rstudioconf jest nadal dostępny w twoim środowisku pracy.

To ćwiczenie jest częścią kursu

Funkcyjne programowanie średnio zaawansowane z purrr

Zobacz kurs

Instrukcje do ćwiczenia

  • Wstępnie wypełnij funkcje mean() i round(), ustawiając odpowiednio na.rm = TRUE i digits = 1.

  • Zbuduj nową funkcję z tych dwóch wstępnie wypełnionych funkcji i nazwij ją rounded_mean().

  • Utwórz podlistę zawierającą tylko tweety, które nie są retweetami.

  • Wyodrębnij element "favorite_count" z każdej podlisty, używając wariantu map_* dla liczb całkowitych, i przekaż wynik do funkcji rounded_mean().

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Prefill mean() with na.rm, and round() with digits = 1
mean_na_rm <- ___(___, ___)
round_one <- ___(___, ___)

# Compose a rounded_mean function
rounded_mean <- ___(___, ___)

# Extract the non retweet  
non_rt <- ___(___, "is_retweet")

# Extract "favorite_count", and pass it to rounded_mean()
non_rt %>%
  map_dbl("___") %>%
  ___()
Edytuj i uruchom kod