樣本數對自助法信賴區間的影響
在先前的單選題中,你已發現如果用錯誤的大小重抽樣(例如用 300 或 3,而不是 30),樣本比例的標準誤(SE)會不正確。當重抽樣觀測值是 300 時,SE 會過小;當重抽樣觀測值是 3 時,SE 會過大。
在這裡,你將使用「錯誤」的標準誤(基於錯誤的樣本數)來建立信賴區間。重點是:當標準誤偏差時,得到的區間既不實用,也不正確。
本練習屬於課程
R 統計推論基礎
練習說明
- 用於計算自助法 t 信賴區間的函式
calc_t_conf_int()已在指令碼中顯示。先閱讀程式碼並理解其作法。 - 對
one_poll_boot呼叫calc_t_conf_int(),計算正確的 t 信賴區間。 - 以同樣方式對
one_poll_boot_300操作,找出樣本數為 300 的重抽樣所得到的錯誤區間。 - 以同樣方式對
one_poll_boot_3操作,找出樣本數為 3 的重抽樣所得到的錯誤區間。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
calc_t_conf_int <- function(resampled_dataset) {
resampled_dataset %>%
summarize(
lower = p_hat - 2 * sd(stat),
upper = p_hat + 2 * sd(stat)
)
}
# Find the bootstrap t-confidence interval for 30 resamples
calc_t_conf_int(___)
# ... and for 300 resamples
___
# ... and for 3 resamples
___