Vykresli vylepšený word cloud
Teď, když jsi odstranil/a další stopslova, pojďme se podívat na vylepšený word cloud!
Matice termínů a dokumentů z předchozího cvičení byla převedena na matici pomocí as.matrix() a následně byl pomocí rowSums() vytvořen pojmenovaný vektor. Tento nový objekt s frekvencemi termínů se jmenuje chardonnay_words a je předem načtený v tvém pracovním prostředí. Podíváme se na výsledky nového word cloudu.
Toto cvičení je součástí kurzu
Dolování textu metodou Bag-of-Words v R
Pokyny k cvičení
Balíček wordcloud jsme za tebe načetli na pozadí — totéž uděláme ve všech dalších cvičeních, která ho vyžadují.
- Seřaď hodnoty v
chardonnay_wordspomocídecreasing = TRUE. Výsledek ulož jakosorted_chardonnay_words. - Podívej se na 6 nejčastějších slov v
sorted_chardonnay_wordsa jejich hodnoty. - Vytvoř
terms_vecpomocínames()aplikovaného nachardonnay_words. - Předej
terms_vecachardonnay_wordsdo funkcewordcloud(). Prohlédni si, která další slova teď vyniknou, když je „chardonnay" odstraněno.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Sort the chardonnay_words in descending order
___ <- ___(___, ___)
# Print the 6 most frequent chardonnay terms
___(___)
# Get a terms vector
___ <- ___(___)
# Create a wordcloud for the values in word_freqs
wordcloud(___, ___,
max.words = 50, colors = "red")