Začněte nyníZačněte zdarma

Výpočet p-hodnot

Ve videu sis ukázal/a, že p-hodnota měří míru neshody mezi daty a nulovou hypotézou. Teď ji vypočítáš pro původní dataset o diskriminaci a také pro jeho malou a velkou variantu, disc_small a disc_big.

V pracovním prostoru máš k dispozici původní rozdíly v proporcích: diff_orig, diff_orig_small a diff_orig_big, a také permutované datasety disc_perm, disc_perm_small a disc_perm_big.

Měj na paměti, že nás zajímá jednostranný test hypotéz – jinými slovy, snažíme se odpovědět na otázku: „Jsou muži s větší pravděpodobností povýšeni než ženy?

Toto cvičení je součástí kurzu

Základy statistické inference v R

Zobrazit kurz

Pokyny k cvičení

  • Použij funkce visualize() a get_p_value() ze zabudovaného balíčku infer. Nezapomeň, že nulové statistiky leží pod původním rozdílem, takže p-hodnota (která udává, jak často je nulová hodnota extrémnější) se vypočítá jako počet nulových hodnot, jež jsou greater (větší) než původní rozdíl.
  • Zopakuj totéž pro malý dataset disc_perm_small s pozorovaným rozdílem diff_orig_small.
  • Zopakuj totéž pro velký dataset disc_perm_big s pozorovaným rozdílem diff_orig_big.
  • Než odešleš odpověď, zkus si vyzkoušet různé hodnoty argumentu: direction = "greater", direction = "two_sided" a direction = "less".

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Visualize and calculate the p-value for the original dataset
disc_perm %>%
  ___(obs_stat = ___, direction = "___")

disc_perm %>%
  ___(___, ___)

# Visualize and calculate the p-value for the small dataset
___ %>%
  ___(___, ___)

___ %>%
  ___(___, ___)

# Visualize and calculate the p-value for the big dataset
___ %>%
  ___(___, ___)

___ %>%
  ___(___, ___)
Upravit a spustit kód