Чи походять дані з генеральної сукупності?
Згадайте, що спостережувана різниця (тобто різниця часток у наборі даних homes, показана як червона вертикальна лінія) була близько -0,0078 і, здається, лежить нижче основної частини щільності перетасованих різниць. Однак важливо з'ясувати, чи були якісь випадково переставлені різниці настільки ж екстремальними, як спостережувана різниця.
У цій вправі ви відтворите цю крапкову діаграму як графік щільності та порахуєте кількість переставлених різниць, що опинилися лівіше від спостережуваної різниці.
Ця вправа є частиною курсу
Основи інференції в R
Інструкції до вправи
Набір даних homeown_perm доступний у вашому робочому середовищі.
- За допомогою
geom_density()побудуйте графік переставлених різниць. - Додайте вертикальну червону лінію з
geom_vline()у точці, де лежить спостережувана різниця. Зміннаdiff_origдоступна у вашому робочому середовищі та представляє початкове значення статистики різниці. - Порахуйте кількість переставлених різниць, що були меншими або дорівнювали спостережуваній різниці.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Plot permuted differences, diff_perm
ggplot(homeown_perm, aes(x = ___)) +
# Add a density layer
___() +
# Add a vline layer with intercept diff_orig
___(aes(xintercept = ___), color = "red")
# Compare permuted differences to observed difference
homeown_perm %>%
summarize(n_perm_le_obs = sum(___ <= ___))