Получение лексиконов тональности
До сих пор вы использовали один лексикон. Теперь мы перейдём к работе с тремя — каждый из них измеряет тональность по-своему.
Пакет tidytext содержит функцию get_sentiments, которая вместе с пакетом [textdata] позволяет загружать хорошо изученные лексиконы и работать с ними. Ниже приведён небольшой фрагмент лексикона loughran.
| Слово | Тональность |
|---|---|
| abandoned | negative |
| abandoning | negative |
| abandonment | negative |
| abandonments | negative |
| abandons | negative |
Этот лексикон содержит 4150 терминов с соответствующими метками. Мы рассмотрим и другие лексиконы — их структура и способ получения аналогичны.
Давайте воспользуемся tidytext вместе с textdata, чтобы изучить метки слов в других лексиконах!
Это упражнение является частью курса
Анализ тональности в R
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Subset to AFINN
afinn_lex <- get_sentiments("___")
# Count AFINN scores
afinn_lex %>%
___(value)