Randomizacja dyskryminacji ze względu na płeć
Przypomnij sobie, że rozważamy sytuację, w której liczba mężczyzn i kobiet jest stała (reprezentują oni CV), a liczba awansowanych osób jest ustalona (menedżerowie mogli awansować tylko 35 osób).
W tym ćwiczeniu stworzysz rozkład randomizacyjny statystyki zerowej z 1000 replikatami, zamiast jedynie 5 jak w poprzednim ćwiczeniu. Dla przypomnienia: statystyką, którą się tu zajmujemy, jest różnica w odsetkach awansowanych między płciami (tzn. odsetek dla mężczyzn minus odsetek dla kobiet). Na podstawie oryginalnego zbioru danych możesz obliczyć, jak różnią się wskaźniki awansu dla mężczyzn i kobiet. Korzystając z przepływu pracy specify-hypothesis-generate-calculate w pakiecie infer, możesz obliczyć tę samą statystykę – tym razem jednak zamiast pojedynczej liczby otrzymasz cały rozkład. W tym ćwiczeniu porównasz tę pojedynczą wartość z oryginalnego zbioru danych z rozkładem uzyskanym w symulacji.
To ćwiczenie jest częścią kursu
Podstawy wnioskowania statystycznego w R
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Calculate the observed difference in promotion rate
diff_orig <- disc %>%
# Group by sex
group_by(___) %>%
# Summarize to calculate fraction promoted
___(prop_prom = ___(___)) %>%
# Summarize to calculate difference
___(stat = ___(___)) %>%
pull()
# See the result
diff_orig