Kom igångKom igång gratis

Beräkna spridningsmått

Nu utökar vi den kraftfulla syntaxen med group_by() och summarize() till spridningsmått. Om du är osäker på om dina fördelningar är symmetriska eller skeva är det klokt att också använda ett robust mått som IQR, utöver de vanliga måtten varians och standardavvikelse.

Den här övningen är en del av kursen

Exploratory Data Analysis in R

Visa kurs

Övningsinstruktioner

Datamängden gap2007 som du skapade i en tidigare övning finns tillgänglig i din arbetsmiljö.

  • Summera medellivslängderna för varje kontinent i gap2007 med hjälp av sd(), IQR() och antalet länder, n(). Du behöver inte namnge de nya kolumnerna. Funktionen n() i ditt summarize()-anrop tar inga argument.
  • Jämför spridningen i dessa fördelningar visuellt genom att skapa överlappande densitetsdiagram för medellivslängd uppdelat per kontinent.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Compute groupwise measures of spread
gap2007 %>%
  group_by(___) %>%
  summarize(___,
            ___,
            ___)

# Generate overlaid density plots
gap2007 %>%
  ggplot(aes(x = ___, fill = ___)) +
  geom_density(alpha = 0.3)
Redigera och kör kod