Lägg linjer ovanpå varandra
Med utgångspunkt i föregående övning upprepar du nu urvalsprocessen 100 gånger för att visualisera samplingfördelningen av regressionslinjer från 100 olika slumpmässiga urval av populationen.
Istället för att anropa sample_n() upprepade gånger, som du gjorde i föregående övning, erbjuder rep_sample_n() från paketet oilabs ett smidigt sätt att generera många slumpmässiga urval. Funktionen rep_sample_n() upprepar kommandot sample_n() reps gånger.
Funktionen do() från dplyr låter dig köra lm-anropet separat för varje nivå i en variabel som grupperats med group_by(). Här är gruppvariabeln samplingrepetat, så varje lm körs på ett annat slumpmässigt urval av data.
Den här övningen är en del av kursen
Inferens för linjär regression i R
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Set the seed for reproducibility
set.seed(4747)
# Repeatedly sample the population without replacement
many_samples <- popdata %>%
___
# See the result
glimpse(many_samples)