Zacznij terazZacznij za darmo

Pogrupowane podsumowania

Jak widać, w zbiorze twitter_data jest więcej tweetów niebędących skargami niż skarg. Zanim przejdziesz do analizy samych tweetów, warto przyjrzeć się kilku innym kolumnom. Każdy tweet zawiera informację o liczbie obserwujących danego użytkownika – znajdziesz ją w kolumnie usr_followers_count. Jak myślisz – czy osoby, które składają skargi, mają średnio więcej czy mniej obserwujących niż pozostałe? Pogrupowane podsumowania pozwolą ci szybko znaleźć odpowiedź.

To ćwiczenie jest częścią kursu

Wprowadzenie do analizy tekstu w R

Zobacz kurs

Instrukcje do ćwiczenia

  • Pogrupuj dane według kolumny complaint_label.
  • Oblicz średnią, minimum i maksimum wartości w kolumnie usr_followers_count.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Start with the data frame
___ %>% 
  # Group the data by whether or not the tweet is a complaint
  ___(___) %>% 
  # Compute the mean, min, and max follower counts
  summarize(
    avg_followers = ___(___),
    min_followers = ___(___),
    max_followers = ___(___)
  )
Edytuj i uruchom kod