시작하기무료로 시작하기

데이터가 적을 때의 SE

추정에 사용할 데이터가 적을수록 그 추정에는 더 많은 불확실성이 따릅니다. 이는 표준 오차(standard error)에 반영돼요. 이번 연습 문제에서는 서로 다른 크기의 데이터셋을 살펴보며 이 관계를 체감해 보겠습니다.

gss2016에서 두 개의 더 작은 데이터셋을 준비해 두었습니다. 50개의 관측치가 있는 gss2016_small과 10개의 관측치만 있는 gss2016_smaller입니다.

이 연습은 강의의 일부입니다

R로 배우는 범주형 데이터 추론

강의 보기

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Create bootstrap distribution for proportion
boot_dist_small <- ___ %>%
  # Specify the variable and success
  ___ %>%
  # Generate 500 bootstrap reps
  ___ %>%
  # Calculate the statistic
  ___

# See the result
glimpse(boot_dist_small)
코드 편집 및 실행