ПочатиПочніть безкоштовно

Візуалізація частот слів із використанням факторів

Я додав кілька додаткових користувацьких стоп-слів (зокрема назви авіаліній) і підготував дані для вас. Тепер ви створите більш якісну візуалізацію та побудуєте графік слів, упорядкованих за спаданням за кількістю появ.

Ця вправа є частиною курсу

Вступ до аналізу тексту в R

Переглянути курс

Інструкції до вправи

  • Залиште лише терміни, що трапляються понад 100 разів у non_complaints.
  • Переупорядкуйте стовпець word як фактор, впорядкований за підрахунками слів.
  • Створіть стовпчикову діаграму, використовуючи новий стовпець слів типу factor.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

word_counts <- tidy_twitter %>% 
  filter(complaint_label == "Non-Complaint") %>% 
  count(word) %>% 
  # Keep terms that occur more than 100 times
  ___(___) %>% 
  # Reorder word as an ordered factor by word counts
  ___(word2 = ___(___, ___))

# Plot the new word column with type factor
___(___, aes(___, ___)) +
  ___() +
  ___() +
  ggtitle("Non-Complaint Word Counts")
Редагувати та запускати код