수준 개수 살펴보기
dplyr에는 데이터셋을 탐색할 때 유용한 다른 함수들이 있습니다. 첫 번째는 slice_max(var, n = x)로, var 값에 따라 데이터셋의 앞에서 x개의 행을 가져옵니다. 다른 하나는 pull()로, 열 이름을 제거하고 해당 열의 값만 추출할 수 있습니다.
예를 들어, 고전적인 mtcars 데이터셋에서 mpg 상위 두 값을 값의 집합으로 가져오려면 다음과 같이 작성합니다:
mtcars %>%
slice_max(mpg, n = 2) %>%
pull(mpg)
이 코드는 다음과 같은 결과를 반환합니다:
[1] 32.4 33.9
이 연습은 강의의 일부입니다
Tidyverse로 배우는 범주형 데이터
연습 안내
slice_max()를 사용해 요인 수준의 개수가 가장 큰 3개 행을 출력하세요.- 변수
CurrentJobTitleSelect를 기준으로 필터링한 뒤,pull로 해당 변수의 수준 개수를 추출하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Select the 3 rows with the highest number of levels
number_of_levels %>%
___(num_levels, n = 3)
number_of_levels %>%
# Filter for where the column called variable equals CurrentJobTitleSelect
filter(___) %>%
# Pull num_levels
___