Vizualizace stížností
V poslední kapitole jsme skončili u počtů slov ze stížností. Teď je znázorníme ve sloupcovém grafu.
Balíčky tidyverse a tidytext jsou načteny. Data twitter_data jsou tokenizovaná a standardní stop slova byla odstraněna.
Toto cvičení je součástí kurzu
Úvod do analýzy textu v R
Pokyny k cvičení
- Ponech pouze slova s počtem výskytů vyšším než 100.
- Vytvoř sloupcový graf z
word_countsa namapujwordna osu x. - Otočte osy grafu.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
word_counts <- tidy_twitter %>%
filter(complaint_label == "Complaint") %>%
count(word) %>%
# Keep words with count greater than 100
___(___)
# Create a bar plot using word_counts with x = word
ggplot(___, aes(___, ___)) +
geom_col() +
# Flip the plot coordinates
___()