Stwórz ulepszoną chmurę słów
Teraz, gdy usunięto dodatkowe słowa stopu, czas przyjrzeć się ulepszonej chmurze słów!
Macierz termin–dokument z poprzedniego ćwiczenia została przekształcona w macierz za pomocą as.matrix(), a następnie utworzono nazwany wektor przy użyciu rowSums(). Nowy obiekt z częstościami terminów o nazwie chardonnay_words jest już wczytany do twojego środowiska. Sprawdź, jak wyglądają nowe wyniki chmury słów.
To ćwiczenie jest częścią kursu
Eksploracja tekstu metodą Bag-of-Words w R
Instrukcje do ćwiczenia
Pakiet wordcloud jest załadowany w tle – będzie tak również we wszystkich kolejnych ćwiczeniach, które go wymagają.
- Posortuj wartości w
chardonnay_wordsz parametremdecreasing = TRUE. Zapisz wynik jakosorted_chardonnay_words. - Sprawdź 6 najczęstszych słów w
sorted_chardonnay_wordswraz z ich wartościami. - Utwórz
terms_vec, stosującnames()nachardonnay_words. - Przekaż
terms_vecichardonnay_wordsdo funkcjiwordcloud(). Zwróć uwagę, jakie słowa wysuwają się na pierwszy plan po usunięciu słowa "chardonnay".
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Sort the chardonnay_words in descending order
___ <- ___(___, ___)
# Print the 6 most frequent chardonnay terms
___(___)
# Get a terms vector
___ <- ___(___)
# Create a wordcloud for the values in word_freqs
wordcloud(___, ___,
max.words = 50, colors = "red")