Влияние слов: частотный анализ
Один из простейших способов исследовать данные — частотный анализ. Несмотря на свою простоту, в анализе тональности этот метод может давать удивительно содержательные результаты. В этом упражнении вы построите столбчатую диаграмму, снова используя moby и bing.
Чтобы столбцы располагались от наименьшего значения к наибольшему, воспользуйтесь приёмом с факторами. Функция reorder() позволяет изменить порядок уровней факторной переменной на основе другой переменной-оценки. В данном случае вы переупорядочите факторную переменную term по переменной-оценке polarity.
Это упражнение является частью курса
Анализ тональности в R
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
moby_tidy_sentiment <- moby %>%
# Inner join to bing lexicon by term = word
inner_join(bing, by = c("term" = "word")) %>%
# Count by term and sentiment, weighted by count
count(___, ___, wt = ___) %>%
# Pivot sentiment, using n as values
pivot_wider(names_from = ___, values_from = ___, values_fill = ___) %>%
# Mutate to add a polarity column
mutate(polarity = ___ - ___)
# Review
moby_tidy_sentiment