НачатьНачать бесплатно

Получение лексиконов тональности

До сих пор вы использовали один лексикон. Теперь мы перейдём к работе с тремя — каждый из них измеряет тональность по-своему.

Пакет tidytext содержит функцию get_sentiments, которая вместе с пакетом [textdata] позволяет загружать хорошо изученные лексиконы и работать с ними. Ниже приведён небольшой фрагмент лексикона loughran.

Слово Тональность
abandoned negative
abandoning negative
abandonment negative
abandonments negative
abandons negative

Этот лексикон содержит 4150 терминов с соответствующими метками. Мы рассмотрим и другие лексиконы — их структура и способ получения аналогичны.

Давайте воспользуемся tidytext вместе с textdata, чтобы изучить метки слов в других лексиконах!

Это упражнение является частью курса

Анализ тональности в R

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Subset to AFINN
afinn_lex <- get_sentiments("___")

# Count AFINN scores
afinn_lex %>% 
  ___(value)
Редактировать и запускать код