시작하기무료로 시작하기

수준 제거하기

이전 연습 문제의 분할표에서 일부 수준의 빈도가 매우 낮다는 것을 확인했어요. 분석을 단순화하려면 이런 수준을 제거하는 것이 도움이 됩니다.

R에서는 두 단계가 필요해요. 먼저, 빈도가 매우 낮은 수준을 가진 행을 필터링으로 제거하고, 그다음 droplevels()로 요인 변수에서 해당 수준을 삭제합니다. 이는 droplevels()가 등장 횟수가 1~2회인 수준은 유지하고, 데이터셋에 전혀 존재하지 않는 수준만 삭제하기 때문이에요.

이 연습은 강의의 일부입니다

R로 하는 탐색적 데이터 분석

강의 보기

연습 안내

이전 연습 문제의 분할표는 tab으로 작업 공간에 준비되어 있어요.

  • dplyr 패키지를 로드하세요.
  • tab을 출력해 align의 어느 수준이 총빈도가 가장 적은지 확인하세요.
  • filter()를 사용해 해당 수준을 가진 comics의 모든 행을 제외하고, droplevels()로 사용하지 않는 수준을 제거하세요. 단순화된 데이터셋은 comics_filtered로 저장하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Load dplyr
___

# Print tab
___

# Remove align level
comics_filtered <- ___ %>%
  ___(align != ___) %>%
  ___()

# See the result
comics_filtered
코드 편집 및 실행