Visualisera ordfrekvenser med faktorer
Jag har lagt till ett antal egna stoppord (inklusive flygbolagens namn) och förberett datan åt dig. Nu ska du skapa en förbättrad visualisering och rita upp orden sorterade i fallande ordning efter ordfrekvens.
Den här övningen är en del av kursen
Introduktion till textanalys i R
Övningsinstruktioner
- Behåll bara de termer som förekommer mer än 100 gånger i
non_complaints. - Ordna om kolumnen
wordsom en faktor sorterad efter ordfrekvens. - Skapa ett stapeldiagram med den nya ordkolumnen av typen faktor.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
word_counts <- tidy_twitter %>%
filter(complaint_label == "Non-Complaint") %>%
count(word) %>%
# Keep terms that occur more than 100 times
___(___) %>%
# Reorder word as an ordered factor by word counts
___(word2 = ___(___, ___))
# Plot the new word column with type factor
___(___, aes(___, ___)) +
___() +
___() +
ggtitle("Non-Complaint Word Counts")