Données de gazouillis sur les compagnies aériennes
Le tableau de données twitter_data contient plus de 7 000 gazouillis au sujet de compagnies aériennes. Les gazouillis ont déjà été classés comme plaintes ou non-plaintes dans la colonne complaint_label. Voyons combien de ces gazouillis sont des plaintes.
Sachez qu'il s'agit de vraies données provenant de Twitter et qu'il existe donc un risque qu'elles contiennent des grossièretés ou d'autres contenus offensants (dans cet exercice, et dans tout exercice suivant qui utilise aussi de vraies données de Twitter).
Cette activité fait partie du cours
Introduction à l'analyse de texte en R
Instructions de l’exercice
- Chargez le paquet
tidyverse. - Pour évaluer la taille et le contenu des données, affichez
twitter_data. - Filtrez
twitter_datapour ne conserver que les plaintes. Combien de plaintes trouve-t-on dans les données?
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Load the tidyverse packages
___(___)
# Print twitter_data
___
# Print just the complaints in twitter_data
twitter_data %>%
___(___ == ___)