ПочатиПочніть безкоштовно

Накладіть лінії

Продовжуючи попередню вправу, тепер ви повторите процес вибірки 100 разів, щоб візуалізувати вибірковий розподіл регресійних ліній, згенерованих 100 різними випадковими вибірками з генеральної сукупності.

Замість багаторазових викликів sample_n(), як у попередній вправі, зручно використовувати rep_sample_n() з пакета oilabs для створення багатьох випадкових вибірок. Функція rep_sample_n() повторює команду sample_n() reps разів.

Функція do() з dplyr дає змогу запускати lm окремо для кожного рівня змінної, до якої застосовано group_by(). Тут групувальною змінною є номер реплікації вибірки, тож кожна lm запускається на іншій випадковій вибірці даних.

Ця вправа є частиною курсу

Статистичні висновки для лінійної регресії в R

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Set the seed for reproducibility
set.seed(4747)

# Repeatedly sample the population without replacement
many_samples <- popdata %>%
  ___

# See the result
glimpse(many_samples)
Редагувати та запускати код