Vizualizace četností slov pomocí faktorů
Přidal/a jsem za tebe řadu dalších vlastních stop slov (včetně názvů aerolinek) a data jsem připravil/a. Teď vytvoříš lepší vizualizaci a zobrazíš slova seřazená sestupně podle jejich četnosti.
Toto cvičení je součástí kurzu
Úvod do analýzy textu v R
Pokyny k cvičení
- Ponech pouze výrazy, které se v
non_complaintsvyskytují více než 100krát. - Seřaď sloupec
wordjako faktor uspořádaný podle četností slov. - Vytvoř sloupcový graf s použitím nového sloupcového faktoru.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
word_counts <- tidy_twitter %>%
filter(complaint_label == "Non-Complaint") %>%
count(word) %>%
# Keep terms that occur more than 100 times
___(___) %>%
# Reorder word as an ordered factor by word counts
___(word2 = ___(___, ___))
# Plot the new word column with type factor
___(___, aes(___, ___)) +
___() +
___() +
ggtitle("Non-Complaint Word Counts")