分组汇总
在 twitter_data 中,非投诉的数量多于投诉。您也许开始怀疑这些数据到底是不是来自 Twitter!在查看具体推文之前,twitter_data 中还有几列值得先探索。每条推文都包含该用户的粉丝数,存放在 usr_followers_count 列。您是否预期,抱怨的用户平均粉丝数会比不抱怨的用户更多还是更少?您可以用分组汇总来快速得出答案。
本练习是课程的一部分
R 文本分析入门
练习说明
- 按
complaint_label对数据进行分组。 - 计算
usr_followers_count的平均值、最小值和最大值。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Start with the data frame
___ %>%
# Group the data by whether or not the tweet is a complaint
___(___) %>%
# Compute the mean, min, and max follower counts
summarize(
avg_followers = ___(___),
min_followers = ___(___),
max_followers = ___(___)
)