Výpočet p-hodnot
Ve videu sis ukázal/a, že p-hodnota měří míru neshody mezi daty a nulovou hypotézou. Teď ji vypočítáš pro původní dataset o diskriminaci a také pro jeho malou a velkou variantu, disc_small a disc_big.
V pracovním prostoru máš k dispozici původní rozdíly v proporcích: diff_orig, diff_orig_small a diff_orig_big, a také permutované datasety disc_perm, disc_perm_small a disc_perm_big.
Měj na paměti, že nás zajímá jednostranný test hypotéz – jinými slovy, snažíme se odpovědět na otázku: „Jsou muži s větší pravděpodobností povýšeni než ženy?
Toto cvičení je součástí kurzu
Základy statistické inference v R
Pokyny k cvičení
- Použij funkce
visualize()aget_p_value()ze zabudovaného balíčkuinfer. Nezapomeň, že nulové statistiky leží pod původním rozdílem, takže p-hodnota (která udává, jak často je nulová hodnota extrémnější) se vypočítá jako počet nulových hodnot, jež jsougreater(větší) než původní rozdíl. - Zopakuj totéž pro malý dataset
disc_perm_smalls pozorovaným rozdílemdiff_orig_small. - Zopakuj totéž pro velký dataset
disc_perm_bigs pozorovaným rozdílemdiff_orig_big. - Než odešleš odpověď, zkus si vyzkoušet různé hodnoty argumentu:
direction = "greater",direction = "two_sided"adirection = "less".
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Visualize and calculate the p-value for the original dataset
disc_perm %>%
___(obs_stat = ___, direction = "___")
disc_perm %>%
___(___, ___)
# Visualize and calculate the p-value for the small dataset
___ %>%
___(___, ___)
___ %>%
___(___, ___)
# Visualize and calculate the p-value for the big dataset
___ %>%
___(___, ___)
___ %>%
___(___, ___)