ggplot2 오차 한계 그래프 사용자 지정
이전 연습 문제에서 만든 차트에 몇 가지 문제가 있다는 점을 확인하셨을 거예요. 카운티가 정렬되어 있지 않아 데이터의 패턴을 읽기 어렵습니다. 특히 오차 한계 플롯은 점들을 정렬했을 때 훨씬 효과적인데, 정렬을 통해 시청자가 다른 추정값과 비교하여 추정값의 불확실성을 이해할 수 있기 때문입니다. 또한 플롯 서식이 부족하면 차트의 내용을 파악하기 어려워집니다. 이번 연습에서는 ggplot2 코드를 정리해 훨씬 더 보기 좋은 오차 한계 차트를 만들어 보겠습니다.
이 연습은 강의의 일부입니다
R로 분석하는 미국 인구조사 데이터
연습 안내
str_replace()tidyverse 함수를 사용해 카운티 이름에서" County, Maine"을 제거하세요.- 플롯에서 가계 중위 소득 기준으로 카운티를 내림차순으로 재정렬하세요.
- 데이터 포인트에 공통 정보를 추가하기 위해
subtitle로 부제목을 "Counties in Maine"으로 설정하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Remove unnecessary content from the county's name
maine_inc2 <- maine_inc %>%
mutate(NAME = ___(NAME, " County, Maine", ""))
# Build a margin of error plot incorporating your modifications
ggplot(maine_inc2, aes(x = estimate, y = ___(NAME, estimate))) +
geom_errorbarh(aes(xmin = ___ - moe, xmax = estimate + ___)) +
geom_point(size = 3, color = "darkgreen") +
theme_grey(base_size = 14) +
labs(title = "Median household income",
___ = "Counties in Maine",
x = "ACS estimate (bars represent margins of error)",
y = "") +
scale_x_continuous(labels = scales::dollar)