ÎncepețiÎncepe gratuit

Rezumate grupate

Așadar, în twitter_data există mai multe tweet-uri care nu sunt reclamații decât cele care sunt. Poate că ai început să te întrebi dacă datele provin cu adevărat de pe Twitter! Mai există câteva coloane interesante în twitter_data pe care merită să le explorezi înainte de a ajunge la tweet-urile propriu-zise. Fiecare tweet include numărul de urmăritori ai utilizatorului respectiv, în coloana usr_followers_count. Te aștepți ca cei care reclamă să aibă mai mulți sau mai puțini urmăritori, în medie, față de cei care nu reclamă? Poți folosi rezumate grupate pentru a răspunde rapid și ușor la această întrebare.

Acest exercițiu face parte din cursul

Introducere în analiza textului în R

Vezi cursul

Instrucțiuni pentru exercițiu

  • Grupează datele după complaint_label.
  • Calculează media, minimul și maximul pentru usr_followers_count.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Start with the data frame
___ %>% 
  # Group the data by whether or not the tweet is a complaint
  ___(___) %>% 
  # Compute the mean, min, and max follower counts
  summarize(
    avg_followers = ___(___),
    min_followers = ___(___),
    max_followers = ___(___)
  )
Editează și rulează codul