क्या डेटा जनसंख्या से आता है?
याद कीजिए कि देखा गया अंतर (यानी homes डेटासेट में proportions का अंतर, जिसे लाल वर्टिकल लाइन से दिखाया गया है) लगभग -0.0078 था, जो शफ़ल किए गए अंतरों की डेंसिटी के मुख्य भाग से नीचे दिखता है। लेकिन यह जानना ज़रूरी है कि क्या रैंडमली परमीूट किए गए किसी भी अंतर का मान, देखे गए अंतर जितना चरम था या नहीं।
इस अभ्यास में, आप इसी डॉटप्लॉट को एक डेंसिटी प्लॉट के रूप में फिर से बनाएँगे और यह गिनेंगे कि परमीूट किए गए कितने अंतर, देखे गए अंतर के बाएँ पड़े थे।
यह अभ्यास पाठ्यक्रम का हिस्सा है
R में Inference की बुनियाद
अभ्यास निर्देश
homeown_perm डेटासेट आपके वर्कस्पेस में उपलब्ध है.
geom_density()का उपयोग करके परमीूट किए गए अंतरों का प्लॉट बनाएँ.- जहाँ देखा गया अंतर आता है, वहाँ
geom_vline()से एक लाल वर्टिकल लाइन जोड़ें।diff_origआपके वर्कस्पेस में उपलब्ध है और यह difference statistic के मूल मान का प्रतिनिधित्व करता है. - उन परमीूट किए गए अंतरों की गिनती करें जो देखे गए अंतर से छोटे या बराबर थे.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Plot permuted differences, diff_perm
ggplot(homeown_perm, aes(x = ___)) +
# Add a density layer
___() +
# Add a vline layer with intercept diff_orig
___(aes(xintercept = ___), color = "red")
# Compare permuted differences to observed difference
homeown_perm %>%
summarize(n_perm_le_obs = sum(___ <= ___))