Rozcvička s manipulací dat
Pojďme si trochu procvičit práci s daty v tidyverse a podívat se na počet hlášených případů podle roku pro americký region ('AMR').
Nejprve dataset filtrujeme na požadovaný region a pak vytvoříme jednoduchý bodový graf závislosti počtu případů na roce.
Navíc nastav průhlednost bodů na 50 % (0.5), abychom získali představu o překryvu dat.
Toto cvičení je součástí kurzu
Vizualizace dat v R – nejlepší postupy
Pokyny k cvičení
- Filtruj
who_diseasetak, aby dataset obsahoval pouze data z regionu'AMR'. - Uprav estetiku tak, aby osa x odpovídala proměnné
yeara osa y proměnnécases. - Snižte průhlednost (
alpha) bodů na0.5, aby byl vgeom_point()vidět případný překryv dat.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# filter data to AMR region.
amr_region <- who_disease %>%
___(___)
# map x to year and y to cases.
ggplot(amr_region, aes(___)) +
# lower alpha to 0.5 to see overlap.
geom_point(___)