Zliczanie polubionych tweetów
Kontynuujmy eksplorację zbioru danych RStudio Conf. Przypomnij sobie, że jest to lista ponad 5000 podlist – każda z nich reprezentuje tweet zawierający hashtag #RStudioConf.
W tym ćwiczeniu wyodrębnimy statystykę dotyczącą tweetów, które nie były retweetami: średnią liczbę polubień. Element "favorite_count" zawarty w każdej podliście to liczba osób, które polubiły dany tweet.
Biblioteka purrr jest już załadowana, a zbiór danych rstudioconf jest nadal dostępny w twoim środowisku pracy.
To ćwiczenie jest częścią kursu
Funkcyjne programowanie średnio zaawansowane z purrr
Instrukcje do ćwiczenia
Wstępnie wypełnij funkcje
mean()iround(), ustawiając odpowiedniona.rm = TRUEidigits = 1.Zbuduj nową funkcję z tych dwóch wstępnie wypełnionych funkcji i nazwij ją
rounded_mean().Utwórz podlistę zawierającą tylko tweety, które nie są retweetami.
Wyodrębnij element
"favorite_count"z każdej podlisty, używając wariantumap_*dla liczb całkowitych, i przekaż wynik do funkcjirounded_mean().
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Prefill mean() with na.rm, and round() with digits = 1
mean_na_rm <- ___(___, ___)
round_one <- ___(___, ___)
# Compose a rounded_mean function
rounded_mean <- ___(___, ___)
# Extract the non retweet
non_rt <- ___(___, "is_retweet")
# Extract "favorite_count", and pass it to rounded_mean()
non_rt %>%
map_dbl("___") %>%
___()