簡單隨機抽樣
抽樣母體最簡單的方法就是你已經看過的那一種。它稱為「簡單隨機抽樣」(有時簡寫為「SRS」),做法是一次隨機挑選一列,每一列被挑中的機率都相同。
為了更容易看出哪些列被抽進樣本,在抽樣前先在資料集中加入一個列 ID 欄位會很有幫助。
本章將使用 IBM 的合成(虛構)員工流動資料集來示範各種抽樣方法,其中「attrition」指的是離職。
attrition_pop 已可使用;已載入 dplyr。
本練習屬於課程
R 的抽樣
練習說明
- 檢視
attrition_pop資料集。『在檢視器中先探索,直到你清楚它包含哪些內容。』 - 將隨機種子設定為你自行選擇的值。
- 在資料集加入列 ID 欄位,然後使用簡單隨機抽樣取得 200 列。
- 檢視樣本資料集
attrition_samp。『你對列 ID 有什麼觀察?』
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# View the attrition_pop dataset
___
# Set the seed
___
attrition_samp <- attrition_pop %>%
# Add a row ID column
___ %>%
# Get 200 rows using simple random sampling
___
# View the attrition_samp dataset
___