Накладіть лінії
Продовжуючи попередню вправу, тепер ви повторите процес вибірки 100 разів, щоб візуалізувати вибірковий розподіл регресійних ліній, згенерованих 100 різними випадковими вибірками з генеральної сукупності.
Замість багаторазових викликів sample_n(), як у попередній вправі, зручно використовувати rep_sample_n() з пакета oilabs для створення багатьох випадкових вибірок. Функція rep_sample_n() повторює команду sample_n() reps разів.
Функція do() з dplyr дає змогу запускати lm окремо для кожного рівня змінної, до якої застосовано group_by(). Тут групувальною змінною є номер реплікації вибірки, тож кожна lm запускається на іншій випадковій вибірці даних.
Ця вправа є частиною курсу
Статистичні висновки для лінійної регресії в R
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Set the seed for reproducibility
set.seed(4747)
# Repeatedly sample the population without replacement
many_samples <- popdata %>%
___
# See the result
glimpse(many_samples)