Máme vítěze!
V tomto cvičení identifikujeme důležitou metriku — který uživatel zveřejnil tweet s nejvíce retweety?
Takový typ informace je při analýze sociálních médií klíčový: řekne ti, který tweet je v tvém datasetu nejslavnější. To může v budoucnu pomoct určit hlavní témata a klíčové uživatele pro konkrétní téma nebo hashtag.
Pomocí purrr extrahujeme nejvíce retweetovaný tweet z našeho korpusu a zjistíme, kdo za ním stojí. Protože chceme analýzu provést pouze na původních tweetech, máš k dispozici seznam non_rt, který byl vytvořen v předchozím cvičení.
Toto cvičení je součástí kurzu
Intermediate Functional Programming with purrr
Pokyny k cvičení
Extrahuj všechny elementy
"retweet_count"pomocí vhodné variantymap_*(). Výsledek předej funkcimax().Předvyplň
map_at()tak, aby.atbylo"retweet_count"a.fbyl mapper testující rovnost smax_rt.Tuto novou funkci aplikuj na
non_rt, ponech pouze"retweet_count"a výsledek zploštěl.Vypiš do konzole
$screen_namea$textvýsledku.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Get the max() of "retweet_count"
max_rt <- ___(non_rt, ___) %>%
___()
# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )
res <- non_rt %>%
# Call max_rt_calc() on each element
___(___) %>%
# Keep elements where retweet_count is non-zero
___("___") %>%
# Flatten it
___()
# Print the "screen_name" and "text" of the result
res$screen_name
res$text