Nous avons un gagnant !
Dans cet exercice, nous allons identifier une mesure importante — quel utilisateur a publié le gazouillis ayant le plus de retweets ?
Ce type d'information est essentiel quand vous faites de l'analyse des médias sociaux : il vous indique quel est le gazouillis le plus « célèbre » de votre jeu de données. Cela peut aider, par la suite, à déterminer les thèmes et les utilisateurs clés pour un thème ou un mot-clic précis.
Nous allons utiliser purrr pour extraire le gazouillis le plus relayé de notre corpus et voir qui en est l'auteur. Comme nous voulons effectuer cette analyse uniquement sur les gazouillis originaux, nous vous avons fourni la liste non_rt, créée dans un exercice précédent.
Cette activité fait partie du cours
Programmation fonctionnelle intermédiaire avec purrr
Instructions de l’exercice
Extrayez tous les éléments
"retweet_count"avec la variantemap_*()appropriée. Passez le résultat àmax().Préremplissez un
map_at(), avec.atégal à"retweet_count"et.fétant un mappeur qui teste l'égalité àmax_rt.Appliquez cette nouvelle fonction à
non_rt, conservez uniquement"retweet_count", puis aplatissez le résultat.Affichez dans la console les champs
$screen_nameet$textdu résultat.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Get the max() of "retweet_count"
max_rt <- ___(non_rt, ___) %>%
___()
# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )
res <- non_rt %>%
# Call max_rt_calc() on each element
___(___) %>%
# Keep elements where retweet_count is non-zero
___("___") %>%
# Flatten it
___()
# Print the "screen_name" and "text" of the result
res$screen_name
res$text