Kom igångKom igång gratis

Samplingsfördelning kontra bootstrapfördelning

Samplingsfördelningen och bootstrapfördelningen hänger nära samman. I de sällsynta situationer där du kan ta upprepade urval från en population är det lärorikt att generera båda fördelningarna i följd, för att se hur de förhåller sig till varandra.

Statistikan du är intresserad av är medelvärdet för popularity-poängen bland låtarna.

spotify_population (hela datamängden) och spotify_sample (500 rader som representerar ett ursprungligt urval) är tillgängliga; dplyr är inläst.

Den här övningen är en del av kursen

Urval i R

Visa kurs

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Generate a sampling distribution
mean_popularity_2000_samp <- ___(
  # Use 2000 replicates
  ___,
  expr = {
    # Start with the population
    ___ %>% 
      # Sample 500 rows without replacement
      ___ %>% 
      # Calculate the mean popularity as mean_popularity
      ___ %>% 
      # Pull out the mean popularity
      ___
  }
)

# See the result
mean_popularity_2000_samp
Redigera och kör kod