ПочатиПочніть безкоштовно

Рандомізація гендерної дискримінації

Згадайте, що ми розглядаємо ситуацію, де кількість чоловіків і жінок фіксована (це резюме), і кількість підвищень теж фіксована (менеджери могли підвищити лише 35 осіб).

У цій вправі ви створите розподіл рандомізації нульової статистики зі 1000 повторів, на відміну від лише 5 у попередній вправі. Нагадаємо, нас цікавить різниця часток підвищених між статями (тобто частка для чоловіків мінус частка для жінок). За початковим набором даних можна обчислити, наскільки відрізняються рівні підвищення між чоловіками та жінками. Використовуючи робочий процес specify-hypothesis-generate-calculate у infer, ви можете обчислити ту саму статистику, але замість одного числа отримаєте цілий розподіл. У цій вправі ви порівняєте це одиничне число з початкового набору даних із розподілом, отриманим симуляцією.

Ця вправа є частиною курсу

Основи інференції в R

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Calculate the observed difference in promotion rate
diff_orig <- disc %>%
  # Group by sex
  group_by(___) %>%
  # Summarize to calculate fraction promoted
  ___(prop_prom = ___(___)) %>%
  # Summarize to calculate difference
  ___(stat = ___(___)) %>% 
  pull()
    
# See the result
diff_orig
Редагувати та запускати код