CommencezCommencez gratuitement

Compter par produit et réordonner

tidy_twitter a été tokenisé et les mots vides, y compris les mots vides personnalisés, ont été retirés. Vous souhaitez visualiser les différences de fréquences de mots selon qu'il s'agit de plaintes ou non.

Cette activité fait partie du cours

Introduction à l'analyse de texte en R

Voir le cours

Instructions de l’exercice

  • Comptez les mots selon qu'il s'agit ou non d'une plainte.
  • Conservez les 20 mots les plus fréquents selon qu'il s'agit ou non d'une plainte.
  • Retirez le groupement avant de réordonner word comme facteur selon le décompte.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

word_counts <- tidy_twitter %>%
  # Count words by whether or not its a complaint
  ___(___, ___) %>%
  # Group by whether or not its a complaint
  group_by(___) %>%
  # Keep the top 20 words
  ___(___, ___) %>%
  # Ungroup before reordering word as a factor by the count
  ___() %>%
  ___(word2 = ___(___, ___))
Modifier et exécuter le code