Данные о твитах авиакомпаний
Фрейм данных twitter_data содержит более 7 000 твитов об авиакомпаниях. Каждый твит уже отнесён к одной из двух категорий — жалоба или не жалоба — в столбце complaint_label. Давайте выясним, сколько из этих твитов являются жалобами.
Обратите внимание: это реальные данные из Twitter, поэтому они могут содержать ненормативную лексику или иной оскорбительный контент (как в данном упражнении, так и в последующих упражнениях, использующих реальные данные Twitter).
Это упражнение является частью курса
Введение в анализ текста на R
Инструкции к упражнению
- Загрузите пакет
tidyverse. - Оцените размер и содержимое данных, выведя
twitter_data. - Отфильтруйте
twitter_data, оставив только жалобы. Сколько жалоб содержится в данных?
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Load the tidyverse packages
___(___)
# Print twitter_data
___
# Print just the complaints in twitter_data
twitter_data %>%
___(___ == ___)