Grupperade sammanfattningar
Det finns alltså fler icke-klagomål än klagomål i twitter_data. Du kanske redan börjar undra om datan verkligen kommer från Twitter! Det finns ytterligare några kolumner i twitter_data som är värda att utforska innan du går vidare till själva tweetsen. Varje tweet innehåller antalet följare som användaren har, i kolumnen usr_followers_count. Tror du att de som klagar har fler eller färre följare i genomsnitt än de som inte klagar? Grupperade sammanfattningar är ett snabbt och enkelt sätt att ta reda på det.
Den här övningen är en del av kursen
Introduktion till textanalys i R
Övningsinstruktioner
- Gruppera data efter
complaint_label. - Beräkna medelvärdet, minimumet och maximumet för
usr_followers_count.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Start with the data frame
___ %>%
# Group the data by whether or not the tweet is a complaint
___(___) %>%
# Compute the mean, min, and max follower counts
summarize(
avg_followers = ___(___),
min_followers = ___(___),
max_followers = ___(___)
)