CommencezCommencez gratuitement

Données de gazouillis sur les compagnies aériennes

Le tableau de données twitter_data contient plus de 7 000 gazouillis au sujet de compagnies aériennes. Les gazouillis ont déjà été classés comme plaintes ou non-plaintes dans la colonne complaint_label. Voyons combien de ces gazouillis sont des plaintes.

Sachez qu'il s'agit de vraies données provenant de Twitter et qu'il existe donc un risque qu'elles contiennent des grossièretés ou d'autres contenus offensants (dans cet exercice, et dans tout exercice suivant qui utilise aussi de vraies données de Twitter).

Cette activité fait partie du cours

Introduction à l'analyse de texte en R

Voir le cours

Instructions de l’exercice

  • Chargez le paquet tidyverse.
  • Pour évaluer la taille et le contenu des données, affichez twitter_data.
  • Filtrez twitter_data pour ne conserver que les plaintes. Combien de plaintes trouve-t-on dans les données?

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Load the tidyverse packages
___(___)

# Print twitter_data
___

# Print just the complaints in twitter_data
twitter_data %>% 
  ___(___ == ___)
Modifier et exécuter le code