Підрахунок за продуктом і перевпорядкування
tidy_twitter уже токенізовано, а стоп-слова, зокрема власні, видалено. Ви хочете візуалізувати відмінності в частотах слів у скаргах і не-скаргах.
Ця вправа є частиною курсу
Вступ до аналізу тексту в R
Інструкції до вправи
- Підрахуйте слова залежно від того, чи є це скаргою, чи ні.
- Залиште топ-20 слів окремо для скарг і не-скарг.
- Зніміть групування перед перевпорядкуванням
wordяк фактора за підрахунком.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
word_counts <- tidy_twitter %>%
# Count words by whether or not its a complaint
___(___, ___) %>%
# Group by whether or not its a complaint
group_by(___) %>%
# Keep the top 20 words
___(___, ___) %>%
# Ungroup before reordering word as a factor by the count
___() %>%
___(word2 = ___(___, ___))