Velikost vzorku pro kritickou oblast
Pomocí randomizačních rozdělení s malým a velkým datasetem vypočítej různé hranice pro statistickou významnost. Zajímají nás hlavně velké kladné rozdíly v míře povýšení, proto počítáme horní kvantily 0,90, 0,95 a 0,99.
Funkce pro výpočet těchto kvantilů, calc_upper_quantiles(), je zobrazena ve skriptu.
Toto cvičení je součástí kurzu
Základy statistické inference v R
Pokyny k cvičení
- Jako referenční bod spusť volání
calc_upper_quantiles()a vypočítej příslušné kvantily pro původní dataset s 1 000 permutovanými rozdíly,disc_perm. - Totéž proveď pro malý dataset,
disc_perm_small… - a pro velký dataset,
disc_perm_big.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
calc_upper_quantiles <- function(dataset) {
dataset %>%
summarize(
q.90 = quantile(stat, p = 0.90),
q.95 = quantile(stat, p = 0.95),
q.99 = quantile(stat, p = 0.99)
)
}
# Recall the quantiles associated with the original dataset
calc_upper_quantiles(disc_perm)
# Calculate the quantiles associated with the small dataset
___
# Calculate the quantiles associated with the big dataset
___