Дані твітів авіаліній
Датафрейм twitter_data містить понад 7 000 твітів про авіалінії. Твіти вже класифіковано як скарги або не скарги у стовпчику complaint_label. Давайте прикинемо, скільки з цих твітів є скаргами.
Зверніть увагу, що це реальні дані з Twitter, тому завжди є ризик, що вони містять нецензурну лексику або інший образливий контент (у цій вправі та будь-яких наступних вправах, де також використовуються реальні дані Twitter).
Ця вправа є частиною курсу
Вступ до аналізу тексту в R
Інструкції до вправи
- Завантажте пакет
tidyverse. - Оцініть розмір і вміст даних, вивівши
twitter_data. - Відфільтруйте
twitter_data, щоб залишилися лише скарги. Скільки скарг у даних?
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Load the tidyverse packages
___(___)
# Print twitter_data
___
# Print just the complaints in twitter_data
twitter_data %>%
___(___ == ___)