Vi har en vinnare!
I den här övningen identifierar vi ett viktigt mått – vilken användare har publicerat tweeten med flest retweets?
Den här typen av information är viktig vid analys av sociala medier: den ger dig uppgifter om den mest "kända" tweeten i din datamängd. Det kan i sin tur hjälpa dig att fastställa vilka nyckelämnen och nyckelanvändare som finns kopplade till ett visst tema eller en viss hashtag.
Vi använder purrr för att extrahera den mest retweetade tweeten från vårt korpus och ta reda på vem som ligger bakom den. Eftersom vi vill att analysen ska köras enbart på originaltweets har vi förberett listan non_rt, som skapades i en tidigare övning.
Den här övningen är en del av kursen
Funktionell programmering på mellannivå med purrr
Övningsinstruktioner
Extrahera alla
"retweet_count"-element med lämplig variant avmap_*(). Skicka resultatet tillmax().Förifyll en
map_at()där.atär"retweet_count"och.fär en mapper som testar likheten medmax_rt.Kör den här nya funktionen på
non_rt, behåll enbart"retweet_count"och platta ut resultatet.Skriv ut
$screen_nameoch$textför resultatet till konsolen.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Get the max() of "retweet_count"
max_rt <- ___(non_rt, ___) %>%
___()
# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )
res <- non_rt %>%
# Call max_rt_calc() on each element
___(___) %>%
# Keep elements where retweet_count is non-zero
___("___") %>%
# Flatten it
___()
# Print the "screen_name" and "text" of the result
res$screen_name
res$text