Підсумовуємо гендерну дискримінацію
Перший крок будь-якого аналізу — переглянути й підсумувати дані. Категоріальні змінні часто підсумовують за допомогою часток, і завжди важливо розуміти знаменник цієї частки.
Вам потрібна частка жінок, яких підвищили, чи частка підвищених осіб, які були жінками? Тут потрібен перший варіант, тож у коді R потрібно зробити group_by() за змінною sex.
Дані дослідження дискримінації доступні у вашому робочому просторі як disc.
Ця вправа є частиною курсу
Основи інференції в R
Інструкції до вправи
- Використайте функцію
count()зdplyr, щоб підрахувати частоти для зміннихsexіpromote. - Підсумуйте дані, застосувавши
group_by()до змінноїsex. - Знайдіть частку тих, кого підвищили. Назвіть цю змінну
promoted_prop. Зверніть увагу: для бінарних змінних частку будь-якого значення можна знайти за допомогою функціїmean()(наприклад,mean(variable == "value")).
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Create a contingency table summarizing the data
disc %>%
# Count the rows by sex, promote
___
# Find proportion of each sex who were promoted
disc %>%
# Group by sex
___
# Calculate proportion promoted summary stat
___