Mamy zwycięzcę!
W tym ćwiczeniu zidentyfikujemy ważną metrykę – który użytkownik opublikował tweet z największą liczbą retweetów?
Taki rodzaj informacji jest istotny podczas analizy mediów społecznościowych: pozwala dowiedzieć się, który tweet ze zbioru danych jest najbardziej „popularny". W przyszłości może to pomóc w ustaleniu kluczowych tematów i użytkowników dla danego tematu/hashtagu.
Wykorzystamy purrr, aby wyodrębnić najczęściej retweetowany tweet z naszego korpusu i sprawdzić, kto jest jego autorem. Ponieważ analizę chcemy przeprowadzić wyłącznie na oryginalnych tweetach, udostępniliśmy listę non_rt, która została utworzona w poprzednim ćwiczeniu.
To ćwiczenie jest częścią kursu
Funkcyjne programowanie średnio zaawansowane z purrr
Instrukcje do ćwiczenia
Wyodrębnij wszystkie elementy
"retweet_count"za pomocą odpowiedniego wariantumap_*()i przekaż wynik do funkcjimax().Uzupełnij
map_at(), ustawiając.atna"retweet_count", a.fna mapper sprawdzający równość zmax_rt.Zastosuj tę nową funkcję na liście
non_rt, zachowaj tylko element"retweet_count"i spłaszcz wynik.Wyświetl w konsoli
$screen_nameoraz$textuzyskanego wyniku.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Get the max() of "retweet_count"
max_rt <- ___(non_rt, ___) %>%
___()
# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )
res <- non_rt %>%
# Call max_rt_calc() on each element
___(___) %>%
# Keep elements where retweet_count is non-zero
___("___") %>%
# Flatten it
___()
# Print the "screen_name" and "text" of the result
res$screen_name
res$text