Podsumowanie danych dotyczących dyskryminacji ze względu na płeć
Pierwszy krok każdej analizy to zapoznanie się z danymi i ich podsumowanie. Zmienne kategoryczne opisuje się zazwyczaj za pomocą proporcji – zawsze warto wiedzieć, co stanowi mianownik tej proporcji.
Czy interesuje cię odsetek kobiet, które awansowały, czy odsetek awansowanych osób, które są kobietami? Tutaj potrzebujesz pierwszej z tych wartości, dlatego w kodzie R należy użyć group_by() na zmiennej sex.
Dane z badania dyskryminacji są dostępne w twoim środowisku jako disc.
To ćwiczenie jest częścią kursu
Podstawy wnioskowania statystycznego w R
Instrukcje do ćwiczenia
- Korzystając z funkcji
count()z pakietudplyr, stwórz tabelę krzyżową zmiennychsexipromote. - Pogrupuj dane, używając
group_by()na zmiennejsex. - Oblicz odsetek awansowanych osób. Nazwij tę zmienną
promoted_prop. Pamiętaj, że w przypadku zmiennych binarnych proporcję danej wartości można wyznaczyć za pomocą funkcjimean()(np.mean(variable == "value")).
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Create a contingency table summarizing the data
disc %>%
# Count the rows by sex, promote
___
# Find proportion of each sex who were promoted
disc %>%
# Group by sex
___
# Calculate proportion promoted summary stat
___