Supprimer des mots vides personnalisés
Les termes les plus fréquents dans un corpus de textes peuvent être visualisés avec des diagrammes en barres ou des nuages de mots.
Cependant, il est important de supprimer d’abord les mots vides personnalisés présents dans le corpus avant d’utiliser ces outils de visualisation.
Dans cet exercice, vous allez vérifier les fréquences des termes et supprimer des mots vides personnalisés du corpus de textes que vous avez créé pour "telemedicine".
Le corpus de textes a été préchargé sous le nom twt_corpus.
Les bibliothèques qdap et tm ont été préchargées pour cet exercice.
Cet exercice fait partie du cours
<cours>Analyzing Social Media Data in R</cours>Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Extract term frequencies for top 60 words and view output
termfreq <- ___(twt_corpus, ___)
termfreq