Візуалізація частот слів із використанням факторів
Я додав кілька додаткових користувацьких стоп-слів (зокрема назви авіаліній) і підготував дані для вас. Тепер ви створите більш якісну візуалізацію та побудуєте графік слів, упорядкованих за спаданням за кількістю появ.
Ця вправа є частиною курсу
Вступ до аналізу тексту в R
Інструкції до вправи
- Залиште лише терміни, що трапляються понад 100 разів у
non_complaints. - Переупорядкуйте стовпець
wordяк фактор, впорядкований за підрахунками слів. - Створіть стовпчикову діаграму, використовуючи новий стовпець слів типу factor.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
word_counts <- tidy_twitter %>%
filter(complaint_label == "Non-Complaint") %>%
count(word) %>%
# Keep terms that occur more than 100 times
___(___) %>%
# Reorder word as an ordered factor by word counts
___(word2 = ___(___, ___))
# Plot the new word column with type factor
___(___, aes(___, ___)) +
___() +
___() +
ggtitle("Non-Complaint Word Counts")