Zacznij terazZacznij za darmo

Randomizacja dyskryminacji ze względu na płeć

Przypomnij sobie, że rozważamy sytuację, w której liczba mężczyzn i kobiet jest stała (reprezentują oni CV), a liczba awansowanych osób jest ustalona (menedżerowie mogli awansować tylko 35 osób).

W tym ćwiczeniu stworzysz rozkład randomizacyjny statystyki zerowej z 1000 replikatami, zamiast jedynie 5 jak w poprzednim ćwiczeniu. Dla przypomnienia: statystyką, którą się tu zajmujemy, jest różnica w odsetkach awansowanych między płciami (tzn. odsetek dla mężczyzn minus odsetek dla kobiet). Na podstawie oryginalnego zbioru danych możesz obliczyć, jak różnią się wskaźniki awansu dla mężczyzn i kobiet. Korzystając z przepływu pracy specify-hypothesis-generate-calculate w pakiecie infer, możesz obliczyć tę samą statystykę – tym razem jednak zamiast pojedynczej liczby otrzymasz cały rozkład. W tym ćwiczeniu porównasz tę pojedynczą wartość z oryginalnego zbioru danych z rozkładem uzyskanym w symulacji.

To ćwiczenie jest częścią kursu

Podstawy wnioskowania statystycznego w R

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Calculate the observed difference in promotion rate
diff_orig <- disc %>%
  # Group by sex
  group_by(___) %>%
  # Summarize to calculate fraction promoted
  ___(prop_prom = ___(___)) %>%
  # Summarize to calculate difference
  ___(stat = ___(___)) %>% 
  pull()
    
# See the result
diff_orig
Edytuj i uruchom kod