Začněte nyníZačněte zdarma

Výpočet měr variability

Pojďme rozšířit práci se syntaxí group_by() a summarize() na míry variability. Pokud si nejsi jistý/jistá, zda pracuješ se symetrickým nebo zešikmeným rozdělením, je dobré zvážit robustní míru, jako je IQR, vedle běžných měr rozptylu nebo směrodatné odchylky.

Toto cvičení je součástí kurzu

Exploratory Data Analysis in R

Zobrazit kurz

Pokyny k cvičení

Dataset gap2007, který jsi vytvořil/a v dřívějším cvičení, máš k dispozici ve svém pracovním prostoru.

  • Pro každý kontinent v datasetu gap2007 shrň střední délku života pomocí sd(), IQR() a počtu zemí n(). Nové sloupce nemusíš pojmenovávat. Funkce n() uvnitř volání summarize() nepřijímá žádné argumenty.
  • Graficky porovnej variabilitu těchto rozdělení pomocí překrývajících se grafů hustoty střední délky života rozčleněných podle kontinentu.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Compute groupwise measures of spread
gap2007 %>%
  group_by(___) %>%
  summarize(___,
            ___,
            ___)

# Generate overlaid density plots
gap2007 %>%
  ggplot(aes(x = ___, fill = ___)) +
  geom_density(alpha = 0.3)
Upravit a spustit kód