Začněte nyníZačněte zdarma

Vykresli vylepšený word cloud

Teď, když jsi odstranil/a další stopslova, pojďme se podívat na vylepšený word cloud!

Matice termínů a dokumentů z předchozího cvičení byla převedena na matici pomocí as.matrix() a následně byl pomocí rowSums() vytvořen pojmenovaný vektor. Tento nový objekt s frekvencemi termínů se jmenuje chardonnay_words a je předem načtený v tvém pracovním prostředí. Podíváme se na výsledky nového word cloudu.

Toto cvičení je součástí kurzu

Dolování textu metodou Bag-of-Words v R

Zobrazit kurz

Pokyny k cvičení

Balíček wordcloud jsme za tebe načetli na pozadí — totéž uděláme ve všech dalších cvičeních, která ho vyžadují.

  • Seřaď hodnoty v chardonnay_words pomocí decreasing = TRUE. Výsledek ulož jako sorted_chardonnay_words.
  • Podívej se na 6 nejčastějších slov v sorted_chardonnay_words a jejich hodnoty.
  • Vytvoř terms_vec pomocí names() aplikovaného na chardonnay_words.
  • Předej terms_vec a chardonnay_words do funkce wordcloud(). Prohlédni si, která další slova teď vyniknou, když je „chardonnay" odstraněno.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Sort the chardonnay_words in descending order
___ <- ___(___, ___)

# Print the 6 most frequent chardonnay terms
___(___)

# Get a terms vector
___ <- ___(___)

# Create a wordcloud for the values in word_freqs
wordcloud(___, ___, 
          max.words = 50, colors = "red")
Upravit a spustit kód