데이터가 적을 때의 SE
추정에 사용할 데이터가 적을수록 그 추정에는 더 많은 불확실성이 따릅니다. 이는 표준 오차(standard error)에 반영돼요. 이번 연습 문제에서는 서로 다른 크기의 데이터셋을 살펴보며 이 관계를 체감해 보겠습니다.
gss2016에서 두 개의 더 작은 데이터셋을 준비해 두었습니다. 50개의 관측치가 있는 gss2016_small과 10개의 관측치만 있는 gss2016_smaller입니다.
이 연습은 강의의 일부입니다
R로 배우는 범주형 데이터 추론
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Create bootstrap distribution for proportion
boot_dist_small <- ___ %>%
# Specify the variable and success
___ %>%
# Generate 500 bootstrap reps
___ %>%
# Calculate the statistic
___
# See the result
glimpse(boot_dist_small)