ПочатиПочніть безкоштовно

Підрахунок за продуктом і перевпорядкування

tidy_twitter уже токенізовано, а стоп-слова, зокрема власні, видалено. Ви хочете візуалізувати відмінності в частотах слів у скаргах і не-скаргах.

Ця вправа є частиною курсу

Вступ до аналізу тексту в R

Переглянути курс

Інструкції до вправи

  • Підрахуйте слова залежно від того, чи є це скаргою, чи ні.
  • Залиште топ-20 слів окремо для скарг і не-скарг.
  • Зніміть групування перед перевпорядкуванням word як фактора за підрахунком.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

word_counts <- tidy_twitter %>%
  # Count words by whether or not its a complaint
  ___(___, ___) %>%
  # Group by whether or not its a complaint
  group_by(___) %>%
  # Keep the top 20 words
  ___(___, ___) %>%
  # Ungroup before reordering word as a factor by the count
  ___() %>%
  ___(word2 = ___(___, ___))
Редагувати та запускати код