카운티별 가장 큰 집단 찾기
dplyr, purrr 같은 패키지의 tidyverse 데이터 전처리 도구는 Census 데이터를 탐색하는 데 매우 강력합니다. tidycensus는 특히 tidyverse 환경에서의 데이터 탐색을 염두에 두고 설계되었어요. 예를 들어, 사용자는 특정 주의 각 카운티에서 규모가 가장 큰 인종/민족 집단이 무엇인지 알고 싶을 수 있습니다. 이는 dplyr의 그룹화 기능을 사용해 각 그룹(ACS 추정치)에서 가장 큰 값을 찾고, 해당 그룹과 일치하는 행만 남기도록 필터링하여 수행할 수 있습니다.
이 연습은 강의의 일부입니다
R로 분석하는 미국 인구조사 데이터
연습 안내
ca_race데이터셋을GEOID열로 그룹화하세요.- 각 그룹(카운티)에서
estimate값이 최댓값과 같은 행만 남기도록 필터링하세요. tally()함수를 사용해 캘리포니아 주 카운티들의 가장 큰 인종/민족 집단 분포를 집계하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Group the dataset and filter the estimate
ca_largest <- ___ %>%
group_by(___) %>%
filter(___ == max(estimate))
head(ca_largest)
# Group the dataset and get a breakdown of the results
ca_largest %>%
___(___) %>%
___()