Mise en tokens et comptage
Examinez le contenu des gazouillis de compagnies aériennes dans twitter_data à l'aide des comptes de mots. Le contenu de chaque gazouillis se trouve dans la colonne tweet_text.
Cette activité fait partie du cours
Introduction à l'analyse de texte en R
Instructions de l’exercice
- Chargez les packages tidyverse et tidytext.
- Mettez en tokens les gazouillis de la colonne
tweet_text. - Calculez les fréquences de mots à partir du texte tokenisé.
- Classez les comptes en ordre décroissant.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Load the tidyverse and tidytext packages
___(___)
___(___)
tidy_twitter <- twitter_data %>%
# Tokenize the twitter data
___(word, ___)
tidy_twitter %>%
# Compute word counts
___(___) %>%
# Arrange the counts in descending order
___(___)