평균의 평균
각 거래당 사용자 수(num_users)의 평균을 알고 싶지만, 이는 회사 전체 기준의 평균을 알아야 Amir의 거래가 회사 평균보다 사용자 수가 많은지 적은지 비교할 수 있어요. 문제는 지난 1년 동안 회사가 만 건이 넘는 거래를 진행해서 모든 데이터를 모으는 것은 현실적이지 않다는 점이에요. 대신 회사 전체에서 데이터를 수집하는 것보다 훨씬 쉬운 방법인 무작위 표본을 여러 번 뽑아 평균을 추정해 보려고 합니다.
회사 전체 거래의 사용자 데이터는 all_deals에 들어 있어요.
이 연습은 강의의 일부입니다
R로 시작하는 통계학 입문
연습 안내
- 난수 시드를
321로 설정하세요. all_deals$num_users에서 크기가 20인 표본을 30번 추출하고, 각 표본의 평균을 구하세요. 표본 평균은sample_means에 저장하세요.sample_means의 평균을 구하세요.amir_deals의num_users열의 평균을 구하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Set seed to 321
___
# Take 30 samples of 20 values of num_users, take mean of each sample
sample_means <- ___(___, ___(___, ___) %>% mean())
# Calculate mean of sample_means
___
# Calculate mean of num_users in amir_deals
___