Úprava grafu marginů chyby v ggplot2
V předchozím cvičení jsi pravděpodobně odhalil/a několik nedostatků vytvořeného grafu. Protože okresy nejsou seřazené, je pro čtenáře obtížné v datech rozpoznat nějaký vzor. Grafy marginů chyby jsou mnohem srozumitelnější, když jsou body seřazeny – řazení totiž umožňuje porovnávat nejistotu jednotlivých odhadů navzájem. Navíc absence formátování ztěžuje pochopení obsahu grafu. V tomto cvičení kód v ggplot2 upravíš tak, aby výsledný graf s marginy chyby vypadal přehledněji a profesionálněji.
Toto cvičení je součástí kurzu
Analýza dat amerického sčítání lidu v R
Pokyny k cvičení
- Pomocí tidyverse funkce
str_replace()odstraň z názvu okresu řetězec" County, Maine". - Seřaď okresy v grafu sestupně podle mediánu příjmu domácností.
- Nastav podtitulek na hodnotu "Counties in Maine", aby graf obsahoval informaci společnou pro všechny datové body – použij parametr
subtitle.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Remove unnecessary content from the county's name
maine_inc2 <- maine_inc %>%
mutate(NAME = ___(NAME, " County, Maine", ""))
# Build a margin of error plot incorporating your modifications
ggplot(maine_inc2, aes(x = estimate, y = ___(NAME, estimate))) +
geom_errorbarh(aes(xmin = ___ - moe, xmax = estimate + ___)) +
geom_point(size = 3, color = "darkgreen") +
theme_grey(base_size = 14) +
labs(title = "Median household income",
___ = "Counties in Maine",
x = "ACS estimate (bars represent margins of error)",
y = "") +
scale_x_continuous(labels = scales::dollar)