การดึง Sentiment Lexicons
จนถึงตอนนี้เราใช้ lexicon เพียงตัวเดียว ต่อไปจะขยายไปใช้สาม lexicon ซึ่งแต่ละตัววัด sentiment ในรูปแบบที่แตกต่างกัน
แพ็กเกจ tidytext มีฟังก์ชันชื่อ get_sentiments ซึ่งเมื่อใช้ร่วมกับแพ็กเกจ [textdata] จะช่วยให้ดาวน์โหลดและใช้งาน lexicons ที่ผ่านการวิจัยมาแล้วได้อย่างสะดวก ด้านล่างนี้คือตัวอย่างส่วนหนึ่งของ loughran lexicon
| Word | Sentiment |
|---|---|
| abandoned | negative |
| abandoning | negative |
| abandonment | negative |
| abandonments | negative |
| abandons | negative |
Lexicon นี้ประกอบด้วย 4,150 คำพร้อมข้อมูลที่เกี่ยวข้อง เราจะสำรวจ lexicons อื่น ๆ ด้วย แต่โครงสร้างและวิธีการดึงข้อมูลจะคล้ายกัน
มาใช้ tidytext ร่วมกับ textdata เพื่อสำรวจป้ายกำกับคำของ lexicons อื่น ๆ กัน!
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การวิเคราะห์ความรู้สึกใน R
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Subset to AFINN
afinn_lex <- get_sentiments("___")
# Count AFINN scores
afinn_lex %>%
___(value)