CommencezCommencez gratuitement

Retirer des mots vides personnalisés

On peut visualiser les termes fréquents d'un corpus de texte avec des diagrammes à barres ou des nuages de mots.

Cependant, il est essentiel de retirer d'abord les mots vides personnalisés présents dans le corpus avant d'utiliser ces outils de visualisation.

Dans cet exercice, vous allez vérifier les fréquences des termes et retirer les mots vides personnalisés du corpus de texte que vous avez créé pour "telemedicine".

Le corpus de texte a été préchargé sous le nom twt_corpus.

Les bibliothèques qdap et tm ont été préchargées pour cet exercice.

Cette activité fait partie du cours

Analyse des données des médias sociaux avec R

Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Extract term frequencies for top 60 words and view output
termfreq  <-  ___(twt_corpus, ___)
termfreq
Modifier et exécuter le code