수준 제거하기
이전 연습 문제의 분할표에서 일부 수준의 빈도가 매우 낮다는 것을 확인했어요. 분석을 단순화하려면 이런 수준을 제거하는 것이 도움이 됩니다.
R에서는 두 단계가 필요해요. 먼저, 빈도가 매우 낮은 수준을 가진 행을 필터링으로 제거하고, 그다음 droplevels()로 요인 변수에서 해당 수준을 삭제합니다. 이는 droplevels()가 등장 횟수가 1~2회인 수준은 유지하고, 데이터셋에 전혀 존재하지 않는 수준만 삭제하기 때문이에요.
이 연습은 강의의 일부입니다
R로 하는 탐색적 데이터 분석
연습 안내
이전 연습 문제의 분할표는 tab으로 작업 공간에 준비되어 있어요.
dplyr패키지를 로드하세요.tab을 출력해align의 어느 수준이 총빈도가 가장 적은지 확인하세요.filter()를 사용해 해당 수준을 가진comics의 모든 행을 제외하고,droplevels()로 사용하지 않는 수준을 제거하세요. 단순화된 데이터셋은comics_filtered로 저장하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Load dplyr
___
# Print tab
___
# Remove align level
comics_filtered <- ___ %>%
___(align != ___) %>%
___()
# See the result
comics_filtered