Kom igångKom igång gratis

Grupperade sammanfattningar

Det finns alltså fler icke-klagomål än klagomål i twitter_data. Du kanske redan börjar undra om datan verkligen kommer från Twitter! Det finns ytterligare några kolumner i twitter_data som är värda att utforska innan du går vidare till själva tweetsen. Varje tweet innehåller antalet följare som användaren har, i kolumnen usr_followers_count. Tror du att de som klagar har fler eller färre följare i genomsnitt än de som inte klagar? Grupperade sammanfattningar är ett snabbt och enkelt sätt att ta reda på det.

Den här övningen är en del av kursen

Introduktion till textanalys i R

Visa kurs

Övningsinstruktioner

  • Gruppera data efter complaint_label.
  • Beräkna medelvärdet, minimumet och maximumet för usr_followers_count.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Start with the data frame
___ %>% 
  # Group the data by whether or not the tweet is a complaint
  ___(___) %>% 
  # Compute the mean, min, and max follower counts
  summarize(
    avg_followers = ___(___),
    min_followers = ___(___),
    max_followers = ___(___)
  )
Redigera och kör kod