Randomizarea discriminării de gen
Reamintim că analizăm o situație în care numărul de bărbați și femei este fix (reprezentând CV-urile), iar numărul de persoane promovate este și el fix (managerii au putut promova doar 35 de persoane).
În acest exercițiu, vei crea o distribuție de randomizare a statisticii nule cu 1000 de replici, față de doar 5 în exercițiul anterior. Ca reminder, statistica de interes este diferența dintre proporțiile de promovare ale celor două genuri (adică proporția pentru bărbați minus proporția pentru femei). Pe baza setului de date original, poți calcula cum diferă ratele de promovare între bărbați și femei. Folosind fluxul specify-hypothesis-generate-calculate din infer, poți calcula aceeași statistică, însă în loc să obții un singur număr, obții o distribuție întreagă. În acest exercițiu, vei compara acel număr din setul de date original cu distribuția generată prin simulare.
Acest exercițiu face parte din cursul
Bazele inferenței în R
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Calculate the observed difference in promotion rate
diff_orig <- disc %>%
# Group by sex
group_by(___) %>%
# Summarize to calculate fraction promoted
___(prop_prom = ___(___)) %>%
# Summarize to calculate difference
___(stat = ___(___)) %>%
pull()
# See the result
diff_orig