Výpočet měr variability
Pojďme rozšířit práci se syntaxí group_by() a summarize() na míry variability. Pokud si nejsi jistý/jistá, zda pracuješ se symetrickým nebo zešikmeným rozdělením, je dobré zvážit robustní míru, jako je IQR, vedle běžných měr rozptylu nebo směrodatné odchylky.
Toto cvičení je součástí kurzu
Exploratory Data Analysis in R
Pokyny k cvičení
Dataset gap2007, který jsi vytvořil/a v dřívějším cvičení, máš k dispozici ve svém pracovním prostoru.
- Pro každý kontinent v datasetu
gap2007shrň střední délku života pomocísd(),IQR()a počtu zemín(). Nové sloupce nemusíš pojmenovávat. Funkcen()uvnitř volánísummarize()nepřijímá žádné argumenty. - Graficky porovnej variabilitu těchto rozdělení pomocí překrývajících se grafů hustoty střední délky života rozčleněných podle kontinentu.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Compute groupwise measures of spread
gap2007 %>%
group_by(___) %>%
summarize(___,
___,
___)
# Generate overlaid density plots
gap2007 %>%
ggplot(aes(x = ___, fill = ___)) +
geom_density(alpha = 0.3)