Distribuția de eșantionare vs. distribuția bootstrap
Distribuția de eșantionare și distribuția bootstrap sunt strâns legate. În situațiile în care poți eșantiona în mod repetat dintr-o populație (aceste ocazii sunt rare) și pe măsură ce le înveți pe amândouă, este util să generezi mai întâi distribuția de eșantionare, apoi distribuția bootstrap, pentru a vedea cum sunt ele corelate.
Statistica care te interesează aici este media scorului popularity al melodiilor.
spotify_population (întregul set de date) și spotify_sample (doar 500 de rânduri, reprezentând un eșantion inițial) sunt disponibile; dplyr este încărcat.
Acest exercițiu face parte din cursul
Eșantionare în R
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Generate a sampling distribution
mean_popularity_2000_samp <- ___(
# Use 2000 replicates
___,
expr = {
# Start with the population
___ %>%
# Sample 500 rows without replacement
___ %>%
# Calculate the mean popularity as mean_popularity
___ %>%
# Pull out the mean popularity
___
}
)
# See the result
mean_popularity_2000_samp