核密度图
现在您已经了解了核密度图,可以亲自创建一个了!请记住,它类似平滑后的直方图,但不受组距的影响。本练习将帮助您根据情感分数构建核密度图。
在本练习中,您将绘制 2 条核密度曲线:一条对应《阿伽门农》,另一条对应《绿野仙踪》。对于两本书,您都需要与 "afinn" 词典执行一次 inner_join()。回顾一下,"afinn" 词典对术语的打分范围是 -5 到 5。整理为整洁格式后,两本书都会保留单词及其在该词典中的对应分数。
之后,您需要使用 bind_rows() 将结果按行绑定为一个更大的数据框,并使用 ggplot2 创建图形。
通过可视化,您可以判断哪本书使用了更多正向或负向的语言。两者显然有重叠,因为多萝西也经历了负面事件,但您可以据此推断:与《阿伽门农》相比,《绿野仙踪》的核密度显示出更高的正向语言概率。
我们已将 ag 和 oz 分别加载为《阿伽门农》和《绿野仙踪》的整洁版数据,并创建了 afinn,它是 tidytext 中 "afinn" 词典的一个子集。
本练习是课程的一部分
R 中的情感分析
交互式实操练习
通过完成这段示例代码来试试这个练习。
ag_afinn <- ag %>%
# Inner join to afinn lexicon
___(___, by = c("term" = "word"))
oz_afinn <- oz %>%
# Inner join to afinn lexicon
___
# Combine
all_df <- ___(agamemnon = ___, oz = ___, .id = "___")