Zacznij terazZacznij za darmo

Podsumowanie danych dotyczących dyskryminacji ze względu na płeć

Pierwszy krok każdej analizy to zapoznanie się z danymi i ich podsumowanie. Zmienne kategoryczne opisuje się zazwyczaj za pomocą proporcji – zawsze warto wiedzieć, co stanowi mianownik tej proporcji.

Czy interesuje cię odsetek kobiet, które awansowały, czy odsetek awansowanych osób, które są kobietami? Tutaj potrzebujesz pierwszej z tych wartości, dlatego w kodzie R należy użyć group_by() na zmiennej sex.

Dane z badania dyskryminacji są dostępne w twoim środowisku jako disc.

To ćwiczenie jest częścią kursu

Podstawy wnioskowania statystycznego w R

Zobacz kurs

Instrukcje do ćwiczenia

  • Korzystając z funkcji count() z pakietu dplyr, stwórz tabelę krzyżową zmiennych sex i promote.
  • Pogrupuj dane, używając group_by() na zmiennej sex.
  • Oblicz odsetek awansowanych osób. Nazwij tę zmienną promoted_prop. Pamiętaj, że w przypadku zmiennych binarnych proporcję danej wartości można wyznaczyć za pomocą funkcji mean() (np. mean(variable == "value")).

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Create a contingency table summarizing the data
disc %>%
  # Count the rows by sex, promote
  ___

# Find proportion of each sex who were promoted
disc %>%
  # Group by sex
  ___
  # Calculate proportion promoted summary stat
  ___
Edytuj i uruchom kod