Získání sentimentových lexikonů
Zatím jsi pracoval/a s jedním lexikonem. Teď přejdeme na tři, z nichž každý měří sentiment jiným způsobem.
Balíček tidytext obsahuje funkci get_sentiments, která společně s balíčkem [textdata] umožňuje stahovat a pracovat s dobře prozkoumanými lexikony. Tady je malá ukázka z lexikonu loughran.
| Slovo | Sentiment |
|---|---|
| abandoned | negative |
| abandoning | negative |
| abandonment | negative |
| abandonments | negative |
| abandons | negative |
Tento lexikon obsahuje 4 150 výrazů s odpovídajícími informacemi. Budeme prozkoumávat i další lexikony, ale jejich struktura a způsob získání jsou podobné.
Použijme tidytext spolu s textdata a prozkoumejme, jak různé lexikony označují slova!
Toto cvičení je součástí kurzu
Sentiment Analysis in R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Subset to AFINN
afinn_lex <- get_sentiments("___")
# Count AFINN scores
afinn_lex %>%
___(value)