Překrytí přímek
Navážeme na předchozí cvičení – proces vzorkování teď zopakuješ 100krát, abys mohl/a vizualizovat rozložení regresních přímek vzniklých ze 100 různých náhodných vzorků populace.
Místo opakovaného volání sample_n(), jako v předchozím cvičení, nabízí rep_sample_n() z balíčku oilabs pohodlný způsob, jak generovat mnoho náhodných vzorků najednou. Funkce rep_sample_n() spustí příkaz sample_n() celkem reps-krát.
Funkce do() z dplyr ti umožní spustit volání lm samostatně pro každou úroveň proměnné seskupené pomocí group_by(). Zde je skupinovou proměnnou replikát vzorku, takže každé lm běží na jiném náhodném vzorku dat.
Toto cvičení je součástí kurzu
Inference for Linear Regression in R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Set the seed for reproducibility
set.seed(4747)
# Repeatedly sample the population without replacement
many_samples <- popdata %>%
___
# See the result
glimpse(many_samples)