Samplingsfördelning kontra bootstrapfördelning
Samplingsfördelningen och bootstrapfördelningen hänger nära samman. I de sällsynta situationer där du kan ta upprepade urval från en population är det lärorikt att generera båda fördelningarna i följd, för att se hur de förhåller sig till varandra.
Statistikan du är intresserad av är medelvärdet för popularity-poängen bland låtarna.
spotify_population (hela datamängden) och spotify_sample (500 rader som representerar ett ursprungligt urval) är tillgängliga; dplyr är inläst.
Den här övningen är en del av kursen
Urval i R
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Generate a sampling distribution
mean_popularity_2000_samp <- ___(
# Use 2000 replicates
___,
expr = {
# Start with the population
___ %>%
# Sample 500 rows without replacement
___ %>%
# Calculate the mean popularity as mean_popularity
___ %>%
# Pull out the mean popularity
___
}
)
# See the result
mean_popularity_2000_samp