開始使用免費開始

隨機化分佈中的樣本數

我們為你建立了兩個新的資料集,它們與原始的歧視資料在比例差異上基本相同。不過,其中一個資料集(disc_small)的規模只有原始資料集的三分之一,另一個(disc_big)則是原始資料集的 10 倍大。

此外,先前使用的相同置換程式碼也已分別在小型與大型資料集上執行,產生了小型與大型的升遷率置換差異分佈(分別為 disc_small_permdisc_big_perm)。

在這個練習中,你會使用這兩個新的分佈,來感受在樣本數差異很大的情況下,差異值會如何變動。特別留意每張圖 x 軸上的變異範圍。

本練習屬於課程

R 統計推論基礎

檢視課程

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# Tabulate the small dataset
disc_small %>% 
  # Select sex and promote
  ___(___, ___)
  
# Do the same for disc_big
___
編輯並執行程式碼