각 지역에서 최저 소득 주 찾기
여러 dplyr 동사를 함께 사용하는 방법을 배웠죠. 여기서는 group_by(), summarize(), slice_min()을 조합해 각 지역에서 소득이 가장 높은 주를 찾아볼 거예요.
여러 열로 그룹화한 후 요약할 때는, summarize()가 그룹 중 하나의 계층만 "벗겨내고" 나머지 그룹은 유지한다는 점을 기억하는 것이 중요해요. 예를 들어 group_by(X, Y) 한 뒤 요약하면, 결과는 여전히 X로 그룹화된 상태로 남아요.
counties_selected <- counties %>%
select(region, state, county, population, income)
이 연습은 강의의 일부입니다
dplyr로 데이터 조작하기
연습 안내
- 각 지역과 주 내 카운티들의 평균 소득을
average_income으로 계산하세요 (group_by()는 이미 되어 있어요). - 각 지역에서
average_income이 가장 낮은 주를 찾으세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
counties_selected %>%
group_by(region, state) %>%
# Calculate average income
___
# Find the lowest income state in each region
___