НачатьНачать бесплатно

Влияние слов: частотный анализ

Один из простейших способов исследовать данные — частотный анализ. Несмотря на свою простоту, в анализе тональности этот метод может давать удивительно содержательные результаты. В этом упражнении вы построите столбчатую диаграмму, снова используя moby и bing.

Чтобы столбцы располагались от наименьшего значения к наибольшему, воспользуйтесь приёмом с факторами. Функция reorder() позволяет изменить порядок уровней факторной переменной на основе другой переменной-оценки. В данном случае вы переупорядочите факторную переменную term по переменной-оценке polarity.

Это упражнение является частью курса

Анализ тональности в R

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

moby_tidy_sentiment <- moby %>% 
  # Inner join to bing lexicon by term = word
  inner_join(bing, by = c("term" = "word")) %>% 
  # Count by term and sentiment, weighted by count
  count(___, ___, wt = ___) %>%
  # Pivot sentiment, using n as values
  pivot_wider(names_from = ___, values_from = ___, values_fill = ___) %>%
  # Mutate to add a polarity column
  mutate(polarity = ___ - ___)

# Review
moby_tidy_sentiment
Редактировать и запускать код