分組摘要
在 twitter_data 中,非抱怨的推文比抱怨多。你可能開始懷疑這資料到底是不是來自 Twitter!在查看推文本身之前,twitter_data 裡還有幾個值得先探索的欄位。每則推文都包含該使用者的追蹤者數,存於 usr_followers_count 欄位。你預期抱怨的使用者,平均起來會比未抱怨的使用者擁有更多還是更少的追蹤者?你可以用分組摘要快速得到答案。
本練習屬於課程
R 文字分析入門
練習說明
- 依
complaint_label分組資料。 - 計算
usr_followers_count的平均值、最小值與最大值。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Start with the data frame
___ %>%
# Group the data by whether or not the tweet is a complaint
___(___) %>%
# Compute the mean, min, and max follower counts
summarize(
avg_followers = ___(___),
min_followers = ___(___),
max_followers = ___(___)
)