Randomizace genderové diskriminace
Připomeňme si situaci, kdy je počet mužů a žen pevně daný (reprezentují životopisy) a počet povýšených osob je také pevně daný (manažeři mohli povýšit pouze 35 lidí).
V tomto cvičení vytvoříš randomizační rozdělení nulové statistiky s 1000 replikacemi – místo pouhých 5 z předchozího cvičení. Pro připomenutí: sledovanou statistikou je rozdíl v podílech povýšených mezi pohlavími (tj. podíl u mužů minus podíl u žen). Z původního datasetu můžeš vypočítat, jak se míra povýšení liší mezi muži a ženami. Pomocí pracovního postupu specify-hypothesis-generate-calculate v balíčku infer vypočítáš stejnou statistiku – jenže místo jediného čísla získáš celé rozdělení. V tomto cvičení porovnáš to jediné číslo z původního datasetu s rozdělením vytvořeným simulací.
Toto cvičení je součástí kurzu
Základy statistické inference v R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Calculate the observed difference in promotion rate
diff_orig <- disc %>%
# Group by sex
group_by(___) %>%
# Summarize to calculate fraction promoted
___(prop_prom = ___(___)) %>%
# Summarize to calculate difference
___(stat = ___(___)) %>%
pull()
# See the result
diff_orig