隨機化檢驗:性別歧視
回想我們正在考慮一個情境:男性與女性的人數是固定的(代表履歷),而被晉升的人數也是固定的(主管只能晉升 35 人)。
在這個練習中,你要建立虛無統計量的隨機化分布,共 1000 次重抽,而不是前一題的 5 次。提醒一下,我們關注的統計量是兩個性別的晉升比例差(也就是男性比例減去女性比例)。從原始資料集中,你可以計算男性與女性的晉升率差異。使用 infer 的 specify-hypothesis-generate-calculate 流程,你可以計算相同的統計量,但不只得到單一數值,而是得到一個完整的分布。在這個練習中,你會把原始資料集得到的那個單一數值,與模擬所產生的分布進行比較。
本練習屬於課程
R 統計推論基礎
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Calculate the observed difference in promotion rate
diff_orig <- disc %>%
# Group by sex
group_by(___) %>%
# Summarize to calculate fraction promoted
___(prop_prom = ___(___)) %>%
# Summarize to calculate difference
___(stat = ___(___)) %>%
pull()
# See the result
diff_orig