Beräkna spridningsmått
Nu utökar vi den kraftfulla syntaxen med group_by() och summarize() till spridningsmått. Om du är osäker på om dina fördelningar är symmetriska eller skeva är det klokt att också använda ett robust mått som IQR, utöver de vanliga måtten varians och standardavvikelse.
Den här övningen är en del av kursen
Exploratory Data Analysis in R
Övningsinstruktioner
Datamängden gap2007 som du skapade i en tidigare övning finns tillgänglig i din arbetsmiljö.
- Summera medellivslängderna för varje kontinent i
gap2007med hjälp avsd(),IQR()och antalet länder,n(). Du behöver inte namnge de nya kolumnerna. Funktionenn()i dittsummarize()-anrop tar inga argument. - Jämför spridningen i dessa fördelningar visuellt genom att skapa överlappande densitetsdiagram för medellivslängd uppdelat per kontinent.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Compute groupwise measures of spread
gap2007 %>%
group_by(___) %>%
summarize(___,
___,
___)
# Generate overlaid density plots
gap2007 %>%
ggplot(aes(x = ___, fill = ___)) +
geom_density(alpha = 0.3)