開始使用免費開始

簡單隨機抽樣

抽樣母體最簡單的方法就是你已經看過的那一種。它稱為「簡單隨機抽樣」(有時簡寫為「SRS」),做法是一次隨機挑選一列,每一列被挑中的機率都相同。

為了更容易看出哪些列被抽進樣本,在抽樣前先在資料集中加入一個列 ID 欄位會很有幫助。

本章將使用 IBM 的合成(虛構)員工流動資料集來示範各種抽樣方法,其中「attrition」指的是離職。

attrition_pop 已可使用;已載入 dplyr

本練習屬於課程

R 的抽樣

檢視課程

練習說明

  • 檢視 attrition_pop 資料集。『在檢視器中先探索,直到你清楚它包含哪些內容。』
  • 將隨機種子設定為你自行選擇的值。
  • 在資料集加入列 ID 欄位,然後使用簡單隨機抽樣取得 200 列。
  • 檢視樣本資料集 attrition_samp。『你對列 ID 有什麼觀察?』

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# View the attrition_pop dataset
___

# Set the seed
___

attrition_samp <- attrition_pop %>% 
  # Add a row ID column
  ___ %>% 
  # Get 200 rows using simple random sampling
  ___

# View the attrition_samp dataset
___
編輯並執行程式碼