Slumpmässig fördelning av könsdiskriminering
Kom ihåg att vi utgår från en situation där antalet män och kvinnor är fastställt (de representerar ansökningarna) och att antalet befordrade personer är fastställt (cheferna fick bara befordra 35 individer).
I den här övningen skapar du en slumpmässig fördelning av nollstatistiken med 1 000 replikat, i stället för de 5 du använde i föregående övning. Som en påminnelse är statistiken av intresse skillnaden i andelen befordrade mellan könen (dvs. andelen för män minus andelen för kvinnor). Från den ursprungliga datamängden kan du beräkna hur befordringstakten skiljer sig mellan män och kvinnor. Med arbetsflödet specify-hypothesis-generate-calculate i infer kan du beräkna samma statistik – men i stället för ett enda tal får du en hel fördelning. I den här övningen jämför du det enskilda värdet från den ursprungliga datamängden med fördelningen som simuleringen genererar.
Den här övningen är en del av kursen
Grundläggande inferens i R
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Calculate the observed difference in promotion rate
diff_orig <- disc %>%
# Group by sex
group_by(___) %>%
# Summarize to calculate fraction promoted
___(prop_prom = ___(___)) %>%
# Summarize to calculate difference
___(stat = ___(___)) %>%
pull()
# See the result
diff_orig