시작하기무료로 시작하기

카운티별 가장 큰 집단 찾기

dplyr, purrr 같은 패키지의 tidyverse 데이터 전처리 도구는 Census 데이터를 탐색하는 데 매우 강력합니다. tidycensus는 특히 tidyverse 환경에서의 데이터 탐색을 염두에 두고 설계되었어요. 예를 들어, 사용자는 특정 주의 각 카운티에서 규모가 가장 큰 인종/민족 집단이 무엇인지 알고 싶을 수 있습니다. 이는 dplyr의 그룹화 기능을 사용해 각 그룹(ACS 추정치)에서 가장 큰 값을 찾고, 해당 그룹과 일치하는 행만 남기도록 필터링하여 수행할 수 있습니다.

이 연습은 강의의 일부입니다

R로 분석하는 미국 인구조사 데이터

강의 보기

연습 안내

  • ca_race 데이터셋을 GEOID 열로 그룹화하세요.
  • 각 그룹(카운티)에서 estimate 값이 최댓값과 같은 행만 남기도록 필터링하세요.
  • tally() 함수를 사용해 캘리포니아 주 카운티들의 가장 큰 인종/민족 집단 분포를 집계하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Group the dataset and filter the estimate
ca_largest <- ___ %>%
  group_by(___) %>%
  filter(___ == max(estimate)) 

head(ca_largest)

# Group the dataset and get a breakdown of the results
ca_largest %>% 
  ___(___) %>%
  ___()
코드 편집 및 실행