Výběrové rozdělení vs. bootstrapové rozdělení
Výběrové rozdělení a bootstrapové rozdělení spolu úzce souvisí. V situacích, kdy můžeš opakovaně vzorkovat z populace (což bývá vzácné), je užitečné vygenerovat obě rozdělení – nejprve výběrové, pak bootstrapové – a pozorovat, jak spolu souvisí.
Statistika, která nás zajímá, je průměrné skóre popularity skladeb.
K dispozici máš spotify_population (celý dataset) a spotify_sample (500 řádků reprezentujících původní vzorek); načten je balíček dplyr.
Toto cvičení je součástí kurzu
Vzorkování v R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Generate a sampling distribution
mean_popularity_2000_samp <- ___(
# Use 2000 replicates
___,
expr = {
# Start with the population
___ %>%
# Sample 500 rows without replacement
___ %>%
# Calculate the mean popularity as mean_popularity
___ %>%
# Pull out the mean popularity
___
}
)
# See the result
mean_popularity_2000_samp