產生一個 bootstrap 分佈
產生 bootstrap 分佈的流程與產生抽樣分佈非常相似;只有第一步不同。
建立抽樣分佈時,你從母體開始,進行不放回抽樣。建立 bootstrap 分佈時,你從一個樣本開始,對該樣本進行放回重抽。之後步驟相同:在該樣本/重抽樣本上計算你關心的摘要統計量,然後重複這個流程多次。兩種情況下,你都可以用長條圖視覺化分佈。
這裡,spotify_sample 是 spotify_population 資料集的一個子集。為了更容易看出重抽樣的運作方式,我們加上了列 ID 欄,且僅保留歌手名稱、歌曲名稱,以及 danceability 欄位。
已提供 spotify_sample;已載入 dplyr 與 ggplot2。
本練習屬於課程
R 的抽樣
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Generate 1 bootstrap resample
spotify_1_resample <- ___
# See the result
spotify_1_resample