Зведення за групами
У twitter_data більше твітів без скарг, ніж зі скаргами. Ви можете замислитися, чи ці дані взагалі з Twitter! У twitter_data є ще кілька цікавих стовпців, які варто переглянути, перш ніж переходити безпосередньо до твітів. Кожен твіт містить кількість підписників користувача у стовпці usr_followers_count. Як ви думаєте, ті, хто скаржаться, у середньому мають більше чи менше підписників, ніж ті, хто не скаржаться? Ви можете використати зведення за групами, щоб швидко й просто відповісти на це запитання.
Ця вправа є частиною курсу
Вступ до аналізу тексту в R
Інструкції до вправи
- Згрупуйте дані за
complaint_label. - Обчисліть середнє, мінімальне та максимальне значення для
usr_followers_count.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Start with the data frame
___ %>%
# Group the data by whether or not the tweet is a complaint
___(___) %>%
# Compute the mean, min, and max follower counts
summarize(
avg_followers = ___(___),
min_followers = ___(___),
max_followers = ___(___)
)