CommencezCommencez gratuitement

Mise en tokens et comptage

Examinez le contenu des gazouillis de compagnies aériennes dans twitter_data à l'aide des comptes de mots. Le contenu de chaque gazouillis se trouve dans la colonne tweet_text.

Cette activité fait partie du cours

Introduction à l'analyse de texte en R

Voir le cours

Instructions de l’exercice

  • Chargez les packages tidyverse et tidytext.
  • Mettez en tokens les gazouillis de la colonne tweet_text.
  • Calculez les fréquences de mots à partir du texte tokenisé.
  • Classez les comptes en ordre décroissant.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Load the tidyverse and tidytext packages
___(___)
___(___)

tidy_twitter <- twitter_data %>% 
  # Tokenize the twitter data
  ___(word, ___) 

tidy_twitter %>% 
  # Compute word counts
  ___(___) %>% 
  # Arrange the counts in descending order
  ___(___)
Modifier et exécuter le code