隨機化分佈中的樣本數
我們為你建立了兩個新的資料集,它們與原始的歧視資料在比例差異上基本相同。不過,其中一個資料集(disc_small)的規模只有原始資料集的三分之一,另一個(disc_big)則是原始資料集的 10 倍大。
此外,先前使用的相同置換程式碼也已分別在小型與大型資料集上執行,產生了小型與大型的升遷率置換差異分佈(分別為 disc_small_perm 與 disc_big_perm)。
在這個練習中,你會使用這兩個新的分佈,來感受在樣本數差異很大的情況下,差異值會如何變動。特別留意每張圖 x 軸上的變異範圍。
本練習屬於課程
R 統計推論基礎
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Tabulate the small dataset
disc_small %>%
# Select sex and promote
___(___, ___)
# Do the same for disc_big
___