Temos um vencedor!
Neste exercício, vamos identificar uma métrica importante — quem é o usuário que publicou o tweet com mais retweets?
Esse tipo de informação é essencial quando você faz análise de redes sociais: ela revela qual é o tweet mais “famoso” do seu conjunto de dados. Isso pode ajudar, no futuro, a identificar os principais temas e usuários para um tema/hashtag específico.
Vamos usar purrr para extrair o tweet mais retuitado do nosso corpus e descobrir quem é o usuário por trás desse tweet. Como queremos executar essa análise apenas em tweets originais, fornecemos a lista non_rt, criada em um exercício anterior.
Este exercicio faz parte do curso
Programação Funcional Intermediária com purrr
Instruções do exercicio
Extraia todos os elementos
"retweet_count"com a variantemap_*()apropriada. Passe o resultado paramax().Preencha um
map_at(), com.atsendo"retweet_count"e.fsendo um mapper que testa igualdade commax_rt.Faça o mapeamento dessa nova função em
non_rt, mantenha apenas"retweet_count"e faça o flatten do resultado.Imprima no console o
$screen_namee o$textdo resultado.
exercicio interativo prático
Tente este exercicio completando este código de exemplo.
# Get the max() of "retweet_count"
max_rt <- ___(non_rt, ___) %>%
___()
# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )
res <- non_rt %>%
# Call max_rt_calc() on each element
___(___) %>%
# Keep elements where retweet_count is non-zero
___("___") %>%
# Flatten it
___()
# Print the "screen_name" and "text" of the result
res$screen_name
res$text