Pogrupowane podsumowania
Jak widać, w zbiorze twitter_data jest więcej tweetów niebędących skargami niż skarg. Zanim przejdziesz do analizy samych tweetów, warto przyjrzeć się kilku innym kolumnom. Każdy tweet zawiera informację o liczbie obserwujących danego użytkownika – znajdziesz ją w kolumnie usr_followers_count. Jak myślisz – czy osoby, które składają skargi, mają średnio więcej czy mniej obserwujących niż pozostałe? Pogrupowane podsumowania pozwolą ci szybko znaleźć odpowiedź.
To ćwiczenie jest częścią kursu
Wprowadzenie do analizy tekstu w R
Instrukcje do ćwiczenia
- Pogrupuj dane według kolumny
complaint_label. - Oblicz średnią, minimum i maksimum wartości w kolumnie
usr_followers_count.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Start with the data frame
___ %>%
# Group the data by whether or not the tweet is a complaint
___(___) %>%
# Compute the mean, min, and max follower counts
summarize(
avg_followers = ___(___),
min_followers = ___(___),
max_followers = ___(___)
)