Résumer la discrimination fondée sur le genre
Comme première étape de toute analyse, vous devriez examiner et résumer les données. Les variables catégorielles sont souvent résumées à l'aide de proportions, et il est toujours important de comprendre le dénominateur de la proportion.
Voulez-vous la proportion de femmes qui ont été promues ou la proportion de personnes promues qui étaient des femmes? Ici, vous voulez la première, donc dans votre code R, il faut group_by() la variable sex.
Les données de l'étude sur la discrimination sont disponibles dans votre espace de travail sous le nom disc.
Cette activité fait partie du cours
Fondements de l'inférence en R
Instructions de l’exercice
- À l'aide de la fonction
count()dedplyr, dressez un tableau des variablessexetpromote. - Résumez les données en utilisant
group_by()sur la variablesex. - Trouvez la proportion des personnes qui ont été promues. Nommez cette variable
promoted_prop. Notez qu'avec des variables binaires, la proportion de l'une ou l'autre valeur peut être obtenue avec la fonctionmean()(p. ex.mean(variable == "value")).
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Create a contingency table summarizing the data
disc %>%
# Count the rows by sex, promote
___
# Find proportion of each sex who were promoted
disc %>%
# Group by sex
___
# Calculate proportion promoted summary stat
___