Tracer le nuage de mots amélioré
Maintenant que vous avez retiré des mots vides supplémentaires, examinons le nuage de mots amélioré !
La matrice terme-document de l'exercice précédent a été convertie en matrice avec as.matrix(), puis un vecteur nommé a été créé avec rowSums(). Ce nouvel objet des fréquences de termes, appelé chardonnay_words, est préchargé dans votre espace de travail. Voyons ces nouveaux résultats du nuage de mots.
Cette activité fait partie du cours
Extraction de texte avec sac de mots en R
Instructions de l’exercice
Nous avons chargé le paquet wordcloud pour vous en arrière-plan et nous le ferons pour tous les autres exercices qui en ont besoin.
- Triez les valeurs de
chardonnay_wordsavecdecreasing = TRUE. Enregistrez le résultat danssorted_chardonnay_words. - Examinez les 6 premiers mots de
sorted_chardonnay_wordset leurs valeurs. - Créez
terms_vecen utilisantnames()surchardonnay_words. - Passez
terms_vecetchardonnay_wordsà la fonctionwordcloud(). Voyez quels autres mots ressortent maintenant que « chardonnay » est retiré.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Sort the chardonnay_words in descending order
___ <- ___(___, ___)
# Print the 6 most frequent chardonnay terms
___(___)
# Get a terms vector
___ <- ___(___)
# Create a wordcloud for the values in word_freqs
wordcloud(___, ___,
max.words = 50, colors = "red")