Prosta chmura słów
Dotarłeś już do tego miejsca, więc czas na nowe wyzwanie! Przygotuj się na analizę kolejnej partii 1000 tweetów. Na razie nie wiesz, co je łączy – sprawdź, czy uda ci się to odkryć za pomocą chmury słów. Wartości częstości terminów są już wczytane do twojego środowiska.
Chmura słów to wizualizacja terminów, w której rozmiar czcionki zazwyczaj odpowiada częstości danego słowa, a kolory mogą wskazywać dodatkowe informacje. Na razie trzymamy się prostoty: rozmiar odzwierciedla częstość poszczególnych słów, a my używamy tylko jednego koloru.
Jak pokazano w filmie, funkcja wordcloud() działa w następujący sposób:
wordcloud(words, frequencies, max.words = 500, colors = "blue")
Analizy text miningu często obejmują proste chmury słów. Są one może nieco nadużywane, ale wciąż stanowią przydatne narzędzie do szybkiego zrozumienia treści dużego zbioru tekstów!
term_frequency jest wczytane do twojego środowiska.
To ćwiczenie jest częścią kursu
Eksploracja tekstu metodą Bag-of-Words w R
Instrukcje do ćwiczenia
- Wczytaj pakiet
wordcloud. - Wyświetl pierwszych 10 elementów z
term_frequency. - Wyodrębnij terminy, stosując
names()naterm_frequency. Nadaj wektorowi ciągów znaków nazwęterms_vec. - Utwórz
wordcloud(), używającterms_vecjako słów iterm_frequencyjako wartości. Dodaj parametrymax.words = 50orazcolors = "red".
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Load wordcloud package
# Print the first 10 entries in term_frequency
# Vector of terms
# Create a word cloud for the values in word_freqs