开始使用免费开始使用

核密度图

现在您已经了解了核密度图,可以亲自创建一个了!请记住,它类似平滑后的直方图,但不受组距的影响。本练习将帮助您根据情感分数构建核密度图。

在本练习中,您将绘制 2 条核密度曲线:一条对应《阿伽门农》,另一条对应《绿野仙踪》。对于两本书,您都需要与 "afinn" 词典执行一次 inner_join()。回顾一下,"afinn" 词典对术语的打分范围是 -5 到 5。整理为整洁格式后,两本书都会保留单词及其在该词典中的对应分数。

之后,您需要使用 bind_rows() 将结果按行绑定为一个更大的数据框,并使用 ggplot2 创建图形。

通过可视化,您可以判断哪本书使用了更多正向或负向的语言。两者显然有重叠,因为多萝西也经历了负面事件,但您可以据此推断:与《阿伽门农》相比,《绿野仙踪》的核密度显示出更高的正向语言概率。

我们已将 agoz 分别加载为《阿伽门农》和《绿野仙踪》的整洁版数据,并创建了 afinn,它是 tidytext"afinn" 词典的一个子集。

本练习是课程的一部分

R 中的情感分析

查看课程

交互式实操练习

通过完成这段示例代码来试试这个练习。

ag_afinn <- ag %>% 
  # Inner join to afinn lexicon
  ___(___, by = c("term" = "word"))

oz_afinn <- oz %>% 
  # Inner join to afinn lexicon
  ___ 

# Combine
all_df <- ___(agamemnon = ___, oz = ___, .id = "___")
编辑并运行代码