Extraindo menções
Em cada sublista do conjunto de dados de tweets, há um elemento chamado "mentions_screen_name" (ou seja, os @ de Twitter). Esse elemento contém NULL se não houve menção no tweet, ou um ou mais nomes de perfil mencionados no tweet. Uma forma de detectar uma conta popular a partir de uma lista de tweets é descobrir quem são os usuários mais mencionados em uma coleção específica de tweets.
Primeiro, vamos extrair um vetor com todas as menções e, com esse novo vetor em mãos, vamos contar quantas vezes cada perfil foi mencionado. Para isso, vamos criar uma nova função composta, combinando table() (que conta o número de ocorrências de cada elemento no vetor), sort() e tail().
purrr já foi carregado para você, e rstudioconf está disponível no seu conjunto de dados.
Este exercicio faz parte do curso
Programação Funcional Intermediária com purrr
Instruções do exercicio
Construa uma função que combine
as_vector(),compact()eflatten().Crie uma função que receba dois argumentos:
listewhat. Essa função deve executarmap( list, what )e passar o resultado paraflatten_to_vector.Crie
six_most, uma função que combinetail(),sort()etable().Execute
extractor()emrstudioconfe passe o resultado parasix_most().
exercicio interativo prático
Tente este exercicio completando este código de exemplo.
# Combine as_vector(), compact(), and flatten()
flatten_to_vector <- ___(___, ___, ___)
# Complete the function
extractor <- function(list, what = "mentions_screen_name"){
map( ___ , ___ ) %>%
___()
}
# Create six_most, with tail(), sort(), and table()
six_most <- ___(___, ___, ___)
# Run extractor() on rstudioconf
___(rstudioconf) %>%
___()