Dostosowywanie wykresu marginesu błędu w ggplot2
W poprzednim ćwiczeniu zapewne zauważono pewne problemy z utworzonym wykresem. Ponieważ powiaty nie są posortowane, trudno dostrzec wzorce w danych. Wykresy marginesów błędu są znacznie bardziej czytelne, gdy punkty są uporządkowane – dzięki temu można łatwo ocenić niepewność wartości szacunkowych na tle pozostałych. Ponadto brak odpowiedniego formatowania utrudnia zrozumienie treści wykresu. W tym ćwiczeniu poprawisz swój kod ggplot2, aby stworzyć znacznie bardziej przejrzysty wykres marginesu błędu.
To ćwiczenie jest częścią kursu
Analiza danych ze spisu powszechnego USA w R
Instrukcje do ćwiczenia
- Użyj funkcji
str_replace()z tidyverse, aby usunąć" County, Maine"z nazwy powiatu. - Posortuj powiaty malejąco według mediany dochodu gospodarstwa domowego na wykresie.
- Ustaw podtytuł na "Counties in Maine", aby dodać informację wspólną dla wszystkich punktów danych, korzystając z argumentu
subtitle.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Remove unnecessary content from the county's name
maine_inc2 <- maine_inc %>%
mutate(NAME = ___(NAME, " County, Maine", ""))
# Build a margin of error plot incorporating your modifications
ggplot(maine_inc2, aes(x = estimate, y = ___(NAME, estimate))) +
geom_errorbarh(aes(xmin = ___ - moe, xmax = estimate + ___)) +
geom_point(size = 3, color = "darkgreen") +
theme_grey(base_size = 14) +
labs(title = "Median household income",
___ = "Counties in Maine",
x = "ACS estimate (bars represent margins of error)",
y = "") +
scale_x_continuous(labels = scales::dollar)