取得情緒詞典(Sentiment Lexicons)
到目前為止你只用了單一詞典。現在我們要改為使用 3 種詞典,它們以不同方式量測情緒。
tidytext 套件包含一個名為 get_sentiments 的函式,搭配 [textdata] 套件可以下載並使用經過充分研究的詞典。以下是 loughran 詞典中的一小段:
| Word | Sentiment |
|---|---|
| abandoned | negative |
| abandoning | negative |
| abandonment | negative |
| abandonments | negative |
| abandons | negative |
這個詞典包含 4,150 個詞彙及其對應資訊。我們也會探索其他詞典,但它們的結構與取得方式相近。
讓我們用 tidytext 與 textdata 來探索其他詞典的詞彙標籤吧!
本練習屬於課程
R 情感分析
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Subset to AFINN
afinn_lex <- get_sentiments("___")
# Count AFINN scores
afinn_lex %>%
___(value)