Pocházejí data z populace?
Vzpomeň si, že pozorovaný rozdíl (tedy rozdíl podílů v datasetu homes, znázorněný červenou svislou čárou) byl přibližně -0,0078, což se zdá být pod těžištěm hustoty náhodně permutovaných rozdílů. Je ale důležité vědět, jestli se některé z náhodně permutovaných rozdílů přiblížily pozorovanému rozdílu nebo ho překonaly.
V tomto cvičení znovu vytvoříš tento bodový graf jako graf hustoty a spočítáš, kolik permutovaných rozdílů leží nalevo od pozorovaného rozdílu.
Toto cvičení je součástí kurzu
Základy statistické inference v R
Pokyny k cvičení
Dataset homeown_perm máš k dispozici ve svém pracovním prostředí.
- Pomocí
geom_density()vykresli permutované rozdíly. - Přidej červenou svislou čáru pomocí
geom_vline()na místě, kde leží pozorovaný rozdíl. Proměnnádiff_origje dostupná ve tvém pracovním prostředí a představuje původní hodnotu statistiky rozdílu. - Spočítej, kolik permutovaných rozdílů bylo menší nebo rovno pozorovanému rozdílu.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Plot permuted differences, diff_perm
ggplot(homeown_perm, aes(x = ___)) +
# Add a density layer
___() +
# Add a vline layer with intercept diff_orig
___(aes(xintercept = ___), color = "red")
# Compare permuted differences to observed difference
homeown_perm %>%
summarize(n_perm_le_obs = sum(___ <= ___))