Začněte nyníZačněte zdarma

Vizualizace stížností

V poslední kapitole jsme skončili u počtů slov ze stížností. Teď je znázorníme ve sloupcovém grafu.

Balíčky tidyverse a tidytext jsou načteny. Data twitter_data jsou tokenizovaná a standardní stop slova byla odstraněna.

Toto cvičení je součástí kurzu

Úvod do analýzy textu v R

Zobrazit kurz

Pokyny k cvičení

  • Ponech pouze slova s počtem výskytů vyšším než 100.
  • Vytvoř sloupcový graf z word_counts a namapuj word na osu x.
  • Otočte osy grafu.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

word_counts <- tidy_twitter %>% 
  filter(complaint_label == "Complaint") %>% 
  count(word) %>% 
  # Keep words with count greater than 100
  ___(___)

# Create a bar plot using word_counts with x = word
ggplot(___, aes(___, ___)) +
  geom_col() +
  # Flip the plot coordinates
  ___()
Upravit a spustit kód