Отримання лексиконів сентименту
Дотепер ви використовували один лексикон. Тепер перейдемо до трьох, кожен з яких вимірює сентимент по‑різному.
Пакет tidytext містить функцію get_sentiments, яка разом із пакетом [textdata] дає змогу завантажувати добре досліджені лексикони й зручно з ними працювати. Ось невеликий фрагмент лексикону loughran.
| Word | Sentiment |
|---|---|
| abandoned | negative |
| abandoning | negative |
| abandonment | negative |
| abandonments | negative |
| abandons | negative |
У цьому лексиконі 4150 термінів із відповідною інформацією. Ми розглянемо й інші лексикони, але їхня структура й спосіб отримання подібні.
Скористаймося tidytext разом із textdata, щоб дослідити мітки слів в інших лексиконах!
Ця вправа є частиною курсу
Аналіз тональності в R
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Subset to AFINN
afinn_lex <- get_sentiments("___")
# Count AFINN scores
afinn_lex %>%
___(value)