Permutace krok za krokem
Aby sis lépe porozuměl/a kódu pro vytvoření randomizačního rozdělení, toto cvičení tě provede jednotlivými kroky frameworku infer. Konkrétně uvidíš, jak rozdíly ve vygenerovaných replikátech ovlivňují vypočítané statistiky.
Po spuštění kroků infer si všimni, že čísla se pro každý replikát mírně liší.
Toto cvičení je součástí kurzu
Základy statistické inference v R
Pokyny k cvičení
Balíčky dplyr a infer jsou již načteny, stejně jako datový rámec disc z předchozího cvičení.
- Zavolej funkce pro první tři kroky. Práce je za tebe hotová – tvým úkolem je prozkoumat výsledky prvních tří kroků
infer. - Abys viděl/a efekt permutování:
- seskup permutovaný datový rámec
disc_permpodle nové proměnnéreplicate, pak - pomocí
count()spočítej proměnné zájmu (promotev rámci každéhosex).
- seskup permutovaný datový rámec
- Pomocí
disc_perma funkcecalculate()vypočítej statistiku zájmu. Nastavstatna"diff in props"aordernac("male", "female").
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Replicate the entire data frame, permuting the promote variable
disc_perm <- disc %>%
specify(promote ~ sex, success = "promoted") %>%
hypothesize(null = "independence") %>%
generate(reps = 5, type = "permute")
disc_perm %>%
# Group by replicate
___ %>%
# Count per group
___
disc_perm %>%
# Calculate difference in proportion, male then female
___