Retirer des mots vides personnalisés
On peut visualiser les termes fréquents d'un corpus de texte avec des diagrammes à barres ou des nuages de mots.
Cependant, il est essentiel de retirer d'abord les mots vides personnalisés présents dans le corpus avant d'utiliser ces outils de visualisation.
Dans cet exercice, vous allez vérifier les fréquences des termes et retirer les mots vides personnalisés du corpus de texte que vous avez créé pour "telemedicine".
Le corpus de texte a été préchargé sous le nom twt_corpus.
Les bibliothèques qdap et tm ont été préchargées pour cet exercice.
Cette activité fait partie du cours
Analyse des données des médias sociaux avec R
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Extract term frequencies for top 60 words and view output
termfreq <- ___(twt_corpus, ___)
termfreq