Date din tweets despre companii aeriene
Data frame-ul twitter_data conține peste 7.000 de tweets despre companii aeriene. Acestea au fost deja clasificate ca reclamații sau non-reclamații în coloana complaint_label. Să vedem câte dintre aceste tweets sunt reclamații.
Reține că acestea sunt date reale de pe Twitter și, ca atare, există întotdeauna riscul ca ele să conțină limbaj vulgar sau alt conținut ofensator (în acest exercițiu și în exercițiile următoare care folosesc tot date reale de pe Twitter).
Acest exercițiu face parte din cursul
Introducere în analiza textului în R
Instrucțiuni pentru exercițiu
- Încarcă pachetul
tidyverse. - Fă-ți o idee despre dimensiunea și conținutul datelor afișând
twitter_data. - Filtrează
twitter_dataastfel încât să rămână doar reclamațiile. Câte reclamații există în date?
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Load the tidyverse packages
___(___)
# Print twitter_data
___
# Print just the complaints in twitter_data
twitter_data %>%
___(___ == ___)