Začněte nyníZačněte zdarma

Výběrové rozdělení vs. bootstrapové rozdělení

Výběrové rozdělení a bootstrapové rozdělení spolu úzce souvisí. V situacích, kdy můžeš opakovaně vzorkovat z populace (což bývá vzácné), je užitečné vygenerovat obě rozdělení – nejprve výběrové, pak bootstrapové – a pozorovat, jak spolu souvisí.

Statistika, která nás zajímá, je průměrné skóre popularity skladeb.

K dispozici máš spotify_population (celý dataset) a spotify_sample (500 řádků reprezentujících původní vzorek); načten je balíček dplyr.

Toto cvičení je součástí kurzu

Vzorkování v R

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Generate a sampling distribution
mean_popularity_2000_samp <- ___(
  # Use 2000 replicates
  ___,
  expr = {
    # Start with the population
    ___ %>% 
      # Sample 500 rows without replacement
      ___ %>% 
      # Calculate the mean popularity as mean_popularity
      ___ %>% 
      # Pull out the mean popularity
      ___
  }
)

# See the result
mean_popularity_2000_samp
Upravit a spustit kód