Вилучення рівнів
Таблиця спряженості з попередньої вправи показала, що деякі рівні мають дуже малі частоти. Щоб спростити аналіз, часто варто вилучити такі рівні.
В R це потребує двох кроків: спершу відфільтрувати всі рядки з рівнями, що мають дуже малі частоти, а потім прибрати ці рівні зі змінної-фактора за допомогою droplevels(). Це потрібно, бо функція droplevels() лишає рівні, у яких є лише 1 чи 2 спостереження; вона вилучає лише ті рівні, яких немає у наборі даних.
Ця вправа є частиною курсу
Розвідувальний аналіз даних у R
Інструкції до вправи
Таблиця спряженості з попередньої вправи доступна у вашому робочому середовищі як tab.
- Завантажте пакет
dplyr. - Виведіть
tab, щоб з'ясувати, який рівень змінноїalignмає найменше загальних записів. - Використайте
filter(), щоб відфільтрувати всі рядкиcomicsз цим рівнем, а тоді приберіть невикористаний рівень за допомогоюdroplevels(). Збережіть спрощений набір даних якcomics_filtered.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Load dplyr
___
# Print tab
___
# Remove align level
comics_filtered <- ___ %>%
___(align != ___) %>%
___()
# See the result
comics_filtered