Обчислення p-значень
У відео ви дізналися, що p-значення вимірює ступінь розбіжності між даними та нульовою гіпотезою. Тут ви обчислите p-значення для початкового набору даних про дискримінацію, а також для його малої та великої версій, disc_small і disc_big.
Початкові різниці часток доступні у вашому робочому середовищі як diff_orig, diff_orig_small і diff_orig_big, так само як і пермутовані набори даних disc_perm, disc_perm_small і disc_perm_big.
Пам'ятайте, що тут нас цікавить одностороння перевірка гіпотези. Тобто ви намагаєтеся відповісти на запитання: «Чи частіше підвищують чоловіків, ніж жінок?»
Ця вправа є частиною курсу
Основи інференції в R
Інструкції до вправи
- Використайте
visualize()іget_p_value()із вбудованими функціями пакетаinfer. Пам'ятайте, що нульові статистики розташовані нижче за початкову різницю, тож p-значення (яке показує, як часто нульове значення є більш „екстремальним") обчислюється підрахунком кількості нульових значень, які єgreater, ніж початкова різниця. - Повторіть для малого набору даних
disc_perm_small, у якого спостережувана різниця —diff_orig_small. - Повторіть для великого набору даних
disc_perm_big, у якого спостережувана різниця —diff_orig_big. - Ви можете перевірити себе, спробувавши:
direction = "greater",direction = "two_sided"іdirection = "less"перед тим, як натиснути «Надіслати відповідь».
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Visualize and calculate the p-value for the original dataset
disc_perm %>%
___(obs_stat = ___, direction = "___")
disc_perm %>%
___(___, ___)
# Visualize and calculate the p-value for the small dataset
___ %>%
___(___, ___)
___ %>%
___(___, ___)
# Visualize and calculate the p-value for the big dataset
___ %>%
___(___, ___)
___ %>%
___(___, ___)