Dane z tweetów o liniach lotniczych
Ramka danych twitter_data zawiera ponad 7 000 tweetów dotyczących linii lotniczych. Tweety zostały już sklasyfikowane jako skargi lub nie-skargi w kolumnie complaint_label. Sprawdźmy, ile spośród tych tweetów to skargi.
Pamiętaj, że są to prawdziwe dane z Twittera – istnieje zatem ryzyko, że mogą zawierać wulgaryzmy lub inne nieodpowiednie treści (w tym ćwiczeniu i w kolejnych, które również korzystają z rzeczywistych danych z Twittera).
To ćwiczenie jest częścią kursu
Wprowadzenie do analizy tekstu w R
Instrukcje do ćwiczenia
- Załaduj pakiet
tidyverse. - Wyświetl
twitter_data, aby zorientować się w rozmiarze i zawartości zbioru danych. - Przefiltruj
twitter_datatak, aby zostały tylko skargi. Ile skarg znajduje się w danych?
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Load the tidyverse packages
___(___)
# Print twitter_data
___
# Print just the complaints in twitter_data
twitter_data %>%
___(___ == ___)