CommencerCommencez gratuitement

Supprimer des mots vides personnalisés

Les termes les plus fréquents dans un corpus de textes peuvent être visualisés avec des diagrammes en barres ou des nuages de mots.

Cependant, il est important de supprimer d’abord les mots vides personnalisés présents dans le corpus avant d’utiliser ces outils de visualisation.

Dans cet exercice, vous allez vérifier les fréquences des termes et supprimer des mots vides personnalisés du corpus de textes que vous avez créé pour "telemedicine".

Le corpus de textes a été préchargé sous le nom twt_corpus.

Les bibliothèques qdap et tm ont été préchargées pour cet exercice.

Cet exercice fait partie du cours

<cours>Analyzing Social Media Data in R</cours>
Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Extract term frequencies for top 60 words and view output
termfreq  <-  ___(twt_corpus, ___)
termfreq
Modifier et exécuter le code