НачатьНачать бесплатно

Повторная выборка из выборки

Чтобы изучить, насколько оценки доли в генеральной совокупности меняются от выборки к выборке, вы проведёте два выборочных эксперимента.

В первом эксперименте вы смоделируете повторные выборки из генеральной совокупности. Во втором — возьмёте одну выборку из первого эксперимента и будете многократно брать повторные выборки из неё: этот метод называется бутстрэппингом. Подробнее:

Эксперимент 1: Предположим, что истинная доля людей, готовых проголосовать за кандидата X, равна 0,6. Многократно берите выборки по 30 человек из генеральной совокупности и измеряйте изменчивость \(\hat{p}\) (доли в выборке).

Эксперимент 2: Возьмите одну выборку размером 30 из той же генеральной совокупности. Многократно берите выборки по 30 человек (с возвращением!) из исходной выборки и измеряйте изменчивость \(\hat{p}^*\) (доли в повторной выборке).

Важно понимать, что первый эксперимент требует знания генеральной совокупности и на практике, как правило, невозможен. Второй опирается только на имеющуюся выборку и потому легко применим для любой статистики. К счастью, как вы увидите, изменчивость \(\hat{p}\) — доли «успехов» в выборке — примерно одинакова независимо от того, берём ли мы выборку из генеральной совокупности или повторную выборку из исходной выборки.

Мы создали 1000 случайных выборок размером по 30 из генеральной совокупности. Полученный фрейм данных all_polls доступен в вашем рабочем пространстве. Изучите его перед началом работы.

Это упражнение является частью курса

Основы статистического вывода в R

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Compute p-hat for each poll
ex1_props <- all_polls %>% 
  # Group by poll
  ___(___) %>% 
  # Calculate proportion of yes votes
  ___(stat = ___(___))
  
# Review the result
ex1_props
Редактировать и запускать код