Kommer datan från populationen?
Kom ihåg att den observerade skillnaden (det vill säga skillnaden i proportioner i datamängden homes, markerad som den röda vertikala linjen) var ungefär -0,0078, vilket verkar hamna under större delen av densiteten för de slumpmässiga skillnaderna. Det är dock viktigt att veta om någon av de slumpmässigt permuterade skillnaderna var lika extrema som den observerade skillnaden.
I den här övningen återskapar du punktdiagrammet som ett densitetsdiagram och räknar antalet permuterade skillnader som låg till vänster om den observerade skillnaden.
Den här övningen är en del av kursen
Grundläggande inferens i R
Övningsinstruktioner
Datamängden homeown_perm finns tillgänglig i din arbetsmiljö.
- Använd
geom_density()för att plotta de permuterade skillnaderna. - Lägg till en vertikal röd linje med
geom_vline()vid den observerade skillnadens position.diff_origfinns i din arbetsmiljö och representerar det ursprungliga värdet på differensstatistikan. - Räkna antalet permuterade skillnader som var mindre än eller lika med den observerade skillnaden.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Plot permuted differences, diff_perm
ggplot(homeown_perm, aes(x = ___)) +
# Add a density layer
___() +
# Add a vline layer with intercept diff_orig
___(aes(xintercept = ___), color = "red")
# Compare permuted differences to observed difference
homeown_perm %>%
summarize(n_perm_le_obs = sum(___ <= ___))