Avem un câștigător!
În acest exercițiu, vom identifica o metrică importantă — care este utilizatorul care a publicat tweet-ul cu cele mai multe retweet-uri?
Acest tip de informație este esențial în analiza rețelelor sociale: îți oferă date despre cel mai „faimos" tweet din setul tău de date. Astfel, în viitor, poți stabili care sunt temele și utilizatorii-cheie pentru un anumit subiect/hashtag.
Vom folosi purrr pentru a extrage tweet-ul cu cele mai multe retweet-uri din corpusul nostru și pentru a afla cine se află în spatele acestuia. Deoarece dorim ca analiza să fie realizată doar pe tweet-uri originale, am pus la dispoziție lista non_rt, creată într-un exercițiu anterior.
Acest exercițiu face parte din cursul
Programare funcțională intermediară cu purrr
Instrucțiuni pentru exercițiu
Extrage toate elementele
"retweet_count"cu varianta potrivitămap_*(). Transmite rezultatul funcțieimax().Completează un apel
map_at(), cu.atsetat la"retweet_count"și.ffiind un mapper care verifică egalitatea cumax_rt.Aplică această nouă funcție pe
non_rt, păstrează doar elementele"retweet_count"și aplatizează rezultatul.Afișează în consolă
$screen_nameși$textale rezultatului.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Get the max() of "retweet_count"
max_rt <- ___(non_rt, ___) %>%
___()
# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )
res <- non_rt %>%
# Call max_rt_calc() on each element
___(___) %>%
# Keep elements where retweet_count is non-zero
___("___") %>%
# Flatten it
___()
# Print the "screen_name" and "text" of the result
res$screen_name
res$text