ПочатиПочніть безкоштовно

Чи походять дані з генеральної сукупності?

Згадайте, що спостережувана різниця (тобто різниця часток у наборі даних homes, показана як червона вертикальна лінія) була близько -0,0078 і, здається, лежить нижче основної частини щільності перетасованих різниць. Однак важливо з'ясувати, чи були якісь випадково переставлені різниці настільки ж екстремальними, як спостережувана різниця.

У цій вправі ви відтворите цю крапкову діаграму як графік щільності та порахуєте кількість переставлених різниць, що опинилися лівіше від спостережуваної різниці.

Ця вправа є частиною курсу

Основи інференції в R

Переглянути курс

Інструкції до вправи

Набір даних homeown_perm доступний у вашому робочому середовищі.

  • За допомогою geom_density() побудуйте графік переставлених різниць.
  • Додайте вертикальну червону лінію з geom_vline() у точці, де лежить спостережувана різниця. Змінна diff_orig доступна у вашому робочому середовищі та представляє початкове значення статистики різниці.
  • Порахуйте кількість переставлених різниць, що були меншими або дорівнювали спостережуваній різниці.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Plot permuted differences, diff_perm
ggplot(homeown_perm, aes(x = ___)) + 
  # Add a density layer
  ___() +
  # Add a vline layer with intercept diff_orig
  ___(aes(xintercept = ___), color = "red")

# Compare permuted differences to observed difference
homeown_perm %>%
  summarize(n_perm_le_obs = sum(___ <= ___))
Редагувати та запускати код