Rezumate grupate
Așadar, în twitter_data există mai multe tweet-uri care nu sunt reclamații decât cele care sunt. Poate că ai început să te întrebi dacă datele provin cu adevărat de pe Twitter! Mai există câteva coloane interesante în twitter_data pe care merită să le explorezi înainte de a ajunge la tweet-urile propriu-zise. Fiecare tweet include numărul de urmăritori ai utilizatorului respectiv, în coloana usr_followers_count. Te aștepți ca cei care reclamă să aibă mai mulți sau mai puțini urmăritori, în medie, față de cei care nu reclamă? Poți folosi rezumate grupate pentru a răspunde rapid și ușor la această întrebare.
Acest exercițiu face parte din cursul
Introducere în analiza textului în R
Instrucțiuni pentru exercițiu
- Grupează datele după
complaint_label. - Calculează media, minimul și maximul pentru
usr_followers_count.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Start with the data frame
___ %>%
# Group the data by whether or not the tweet is a complaint
___(___) %>%
# Compute the mean, min, and max follower counts
summarize(
avg_followers = ___(___),
min_followers = ___(___),
max_followers = ___(___)
)