Extraire les mentions
Dans chaque sous-liste de l'ensemble de tweets, il y a un élément nommé "mentions_screen_name" (c.-à-d. les identifiants Twitter). Cet élément contient soit NULL s'il n'y a aucune mention dans le tweet, soit un ou plusieurs noms d'utilisateur mentionnés dans le tweet. Une façon de repérer un compte populaire à partir d'une liste de tweets est d'identifier quels utilisateurs sont les plus souvent mentionnés dans une collection donnée.
Nous allons d'abord extraire un vecteur de toutes les mentions, puis, une fois ce nouveau vecteur obtenu, nous compterons combien de fois chaque profil est mentionné. Pour ce faire, nous allons créer une nouvelle fonction composée, en combinant table() (qui compte le nombre d'occurrences de chaque élément dans le vecteur), sort() et tail().
purrr a été chargé pour vous et rstudioconf est disponible dans votre jeu de données.
Cette activité fait partie du cours
Programmation fonctionnelle intermédiaire avec purrr
Instructions de l’exercice
Créez une fonction qui combine
as_vector(),compact()etflatten().Créez une fonction qui prend deux arguments :
listetwhat. Cette fonction exécuteramap( list, what )et transmettra le résultat àflatten_to_vector.Créez
six_most, une fonction qui combinetail(),sort()ettable().Exécutez
extractor()surrstudioconf, puis transmettez le résultat àsix_most().
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Combine as_vector(), compact(), and flatten()
flatten_to_vector <- ___(___, ___, ___)
# Complete the function
extractor <- function(list, what = "mentions_screen_name"){
map( ___ , ___ ) %>%
___()
}
# Create six_most, with tail(), sort(), and table()
six_most <- ___(___, ___, ___)
# Run extractor() on rstudioconf
___(rstudioconf) %>%
___()