Shrnutí nákladů příležitosti (2)
Teď, když jsi sestavil/a rozdělení náhodné permutace, využiješ ho k posouzení, zda pozorovaný rozdíl v proporcích odpovídá nulovému rozdílu. Tuto shodu (nebo její absenci) změříš pomocí p-hodnoty, tedy podílu permutovaných rozdílů menších nebo rovných pozorovanému rozdílu.
Permutovaný dataset i původní pozorovaná statistika jsou v tvém pracovním prostoru dostupné jako opp_perm a diff_orig.
Použij visualize a get_p_value pomocí vestavěných funkcí balíčku infer. Pamatuj, že nulové statistiky leží nad původním rozdílem, takže p-hodnota (která vyjadřuje, jak často je nulová hodnota extrémnější) se vypočítá jako počet nulových hodnot, které jsou less než původní rozdíl.
Toto cvičení je součástí kurzu
Základy statistické inference v R
Pokyny k cvičení
- Nejprve pomocí
visualizezobraz rozdělení permutovaných statistik – vyznač polohuobs_stat = diff_origa vybarvi hodnoty níže pomocídirection = "less". - Poté pomocí
get_p_valuevypočítej p-hodnotu jako podíl permutovaných statistik, pro které platídirection = "less"nežobs_stat = diff_orig. - Jako alternativní způsob výpočtu p-hodnoty použij
summarize()amean()k určení podílu případů, kdy jsou permutované rozdíly vopp_perm(pojmenovanéstat) menší nebo rovné pozorovanému rozdílu (pojmenovanémudiff_orig). - Vyzkoušej si různé varianty:
direction = "greater",direction = "two_sided"adirection = "less"– otestuj je u obou funkcívisualizeiget_p_value, než odešleš svou odpověď.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Visualize the statistic
opp_perm %>%
___(___, ___)
# Calculate the p-value using `get_p_value`
opp_perm %>%
___(___, ___)
# Calculate the p-value using `summarize`
opp_perm %>%
summarize(p_value = ___)