Анализ данных о гендерной дискриминации
Первый шаг любого анализа — изучить и обобщить данные. Категориальные переменные часто описывают с помощью долей, и важно понимать, что именно служит знаменателем.
Что вас интересует: доля женщин, которых повысили, или доля повышенных сотрудников среди женщин? В данном случае нас интересует первое, поэтому в коде на R необходимо использовать group_by() по переменной sex.
Данные исследования дискриминации доступны в вашем рабочем пространстве под именем disc.
Это упражнение является частью курса
Основы статистического вывода в R
Инструкции к упражнению
- С помощью функции
count()из пакетаdplyrпостройте таблицу частот для переменныхsexиpromote. - Сгруппируйте данные, применив
group_by()по переменнойsex. - Вычислите долю повышенных сотрудников. Назовите эту переменную
promoted_prop. Обратите внимание: для бинарных переменных долю любого из значений можно найти с помощью функцииmean()(например,mean(variable == "value")).
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Create a contingency table summarizing the data
disc %>%
# Count the rows by sex, promote
___
# Find proportion of each sex who were promoted
disc %>%
# Group by sex
___
# Calculate proportion promoted summary stat
___