开始使用免费开始使用

分组汇总

twitter_data 中,非投诉的数量多于投诉。您也许开始怀疑这些数据到底是不是来自 Twitter!在查看具体推文之前,twitter_data 中还有几列值得先探索。每条推文都包含该用户的粉丝数,存放在 usr_followers_count 列。您是否预期,抱怨的用户平均粉丝数会比不抱怨的用户更多还是更少?您可以用分组汇总来快速得出答案。

本练习是课程的一部分

R 文本分析入门

查看课程

练习说明

  • complaint_label 对数据进行分组。
  • 计算 usr_followers_count 的平均值、最小值和最大值。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Start with the data frame
___ %>% 
  # Group the data by whether or not the tweet is a complaint
  ___(___) %>% 
  # Compute the mean, min, and max follower counts
  summarize(
    avg_followers = ___(___),
    min_followers = ___(___),
    max_followers = ___(___)
  )
编辑并运行代码