Zliczanie typów użytkowników
Zliczanie to podstawowe podsumowanie danych kategorycznych. Ponieważ tekst ma charakter kategoryczny, warto dobrze opanować obliczanie liczebności. Zbiór danych twitter_data zawiera skargi i wiadomości niebędące skargami – wskazuje na to kolumna complaint_label. Znajdziesz w nim również kolumnę usr_verified, która informuje, czy dany użytkownik jest zweryfikowany (czyli czy Twitter potwierdził jego tożsamość). Kolumna ta jest typu <lgl>, czyli logicznego. Czy zweryfikowani użytkownicy skarżą się częściej?
To ćwiczenie jest częścią kursu
Wprowadzenie do analizy tekstu w R
Instrukcje do ćwiczenia
- Wczytaj pakiet
tidyverse, który zawieradplyriggplot2. - Przefiltruj dane tak, aby zachować tylko tweety będące skargami.
- Zlicz liczbę zweryfikowanych i niezweryfikowanych użytkowników, którzy złożyli skargi.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Load the tidyverse package
___(___)
twitter_data %>%
# Filter for just the complaints
___(___) %>%
# Count the number of verified and non-verified users
___(___)