Наложение линий
Продолжая предыдущее упражнение, вы повторите процесс выборки 100 раз, чтобы визуализировать выборочное распределение регрессионных прямых, построенных по 100 различным случайным выборкам из генеральной совокупности.
Вместо того чтобы многократно вызывать sample_n(), как в предыдущем упражнении, воспользуйтесь функцией rep_sample_n() из пакета oilabs — она позволяет удобно генерировать множество случайных выборок. Функция rep_sample_n() повторяет команду sample_n() заданное число раз (reps).
Функция do() из пакета dplyr позволяет запускать вызов lm отдельно для каждого уровня переменной, заданной через group_by(). Здесь в качестве группирующей переменной выступает номер реплики выборки, поэтому каждая модель lm строится на отдельной случайной выборке из данных.
Это упражнение является частью курса
Вывод для линейной регрессии в R
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Set the seed for reproducibility
set.seed(4747)
# Repeatedly sample the population without replacement
many_samples <- popdata %>%
___
# See the result
glimpse(many_samples)