Zacznij terazZacznij za darmo

Zliczanie typów użytkowników

Zliczanie to podstawowe podsumowanie danych kategorycznych. Ponieważ tekst ma charakter kategoryczny, warto dobrze opanować obliczanie liczebności. Zbiór danych twitter_data zawiera skargi i wiadomości niebędące skargami – wskazuje na to kolumna complaint_label. Znajdziesz w nim również kolumnę usr_verified, która informuje, czy dany użytkownik jest zweryfikowany (czyli czy Twitter potwierdził jego tożsamość). Kolumna ta jest typu <lgl>, czyli logicznego. Czy zweryfikowani użytkownicy skarżą się częściej?

To ćwiczenie jest częścią kursu

Wprowadzenie do analizy tekstu w R

Zobacz kurs

Instrukcje do ćwiczenia

  • Wczytaj pakiet tidyverse, który zawiera dplyr i ggplot2.
  • Przefiltruj dane tak, aby zachować tylko tweety będące skargami.
  • Zlicz liczbę zweryfikowanych i niezweryfikowanych użytkowników, którzy złożyli skargi.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Load the tidyverse package
___(___)

twitter_data %>% 
  # Filter for just the complaints
  ___(___) %>% 
  # Count the number of verified and non-verified users
  ___(___)
Edytuj i uruchom kod