표본분포 vs. 부트스트랩 분포
표본분포와 부트스트랩 분포는 서로 밀접하게 연결되어 있습니다. 모집단에서 반복해서 표본을 추출할 수 있는 상황(드물긴 합니다)이라면, 두 분포를 순서대로 생성해 보며 서로 어떻게 연관되는지 확인하는 것이 도움이 됩니다.
여기서 관심 있는 통계량은 노래의 popularity 평균 점수입니다.
전체 데이터셋인 spotify_population과, 그중에서 무작위로 500행을 추출한 spotify_sample이 준비되어 있습니다. 또한 pandas와 numpy는 평소와 같은 별칭으로 불러와져 있습니다.
이 연습은 강의의 일부입니다
Python으로 살펴보는 표본추출(Sampling)
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
mean_popularity_2000_samp = []
# Generate a sampling distribution of 2000 replicates
____:
mean_popularity_2000_samp.append(
# Sample 500 rows and calculate the mean popularity
____
)
# Print the sampling distribution results
print(mean_popularity_2000_samp)