统计用户类型
计数是分类数据最基本的汇总方式。文本属于分类数据,因此熟练进行计数非常重要。twitter_data 包含抱怨与非抱怨两类推文,由 complaint_label 列标识,并包含一个表示用户是否经过认证(即已由 Twitter 确认其身份)的列 usr_verified。请注意,该列的类型为 <lgl>,即逻辑型。经过认证的用户更爱抱怨吗?
本练习是课程的一部分
R 文本分析入门
练习说明
- 加载
tidyverse包(其中包含dplyr和ggplot2)。 - 过滤数据,仅保留抱怨类推文。
- 统计发生抱怨的已认证与未认证用户数量。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Load the tidyverse package
___(___)
twitter_data %>%
# Filter for just the complaints
___(___) %>%
# Count the number of verified and non-verified users
___(___)