НачатьНачать бесплатно

Анализ данных о гендерной дискриминации

Первый шаг любого анализа — изучить и обобщить данные. Категориальные переменные часто описывают с помощью долей, и важно понимать, что именно служит знаменателем.

Что вас интересует: доля женщин, которых повысили, или доля повышенных сотрудников среди женщин? В данном случае нас интересует первое, поэтому в коде на R необходимо использовать group_by() по переменной sex.

Данные исследования дискриминации доступны в вашем рабочем пространстве под именем disc.

Это упражнение является частью курса

Основы статистического вывода в R

Посмотреть курс

Инструкции к упражнению

  • С помощью функции count() из пакета dplyr постройте таблицу частот для переменных sex и promote.
  • Сгруппируйте данные, применив group_by() по переменной sex.
  • Вычислите долю повышенных сотрудников. Назовите эту переменную promoted_prop. Обратите внимание: для бинарных переменных долю любого из значений можно найти с помощью функции mean() (например, mean(variable == "value")).

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Create a contingency table summarizing the data
disc %>%
  # Count the rows by sex, promote
  ___

# Find proportion of each sex who were promoted
disc %>%
  # Group by sex
  ___
  # Calculate proportion promoted summary stat
  ___
Редактировать и запускать код