ÎncepețiÎncepe gratuit

Distribuția de eșantionare vs. distribuția bootstrap

Distribuția de eșantionare și distribuția bootstrap sunt strâns legate. În situațiile în care poți eșantiona în mod repetat dintr-o populație (aceste ocazii sunt rare) și pe măsură ce le înveți pe amândouă, este util să generezi mai întâi distribuția de eșantionare, apoi distribuția bootstrap, pentru a vedea cum sunt ele corelate.

Statistica care te interesează aici este media scorului popularity al melodiilor.

spotify_population (întregul set de date) și spotify_sample (doar 500 de rânduri, reprezentând un eșantion inițial) sunt disponibile; dplyr este încărcat.

Acest exercițiu face parte din cursul

Eșantionare în R

Vezi cursul

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Generate a sampling distribution
mean_popularity_2000_samp <- ___(
  # Use 2000 replicates
  ___,
  expr = {
    # Start with the population
    ___ %>% 
      # Sample 500 rows without replacement
      ___ %>% 
      # Calculate the mean popularity as mean_popularity
      ___ %>% 
      # Pull out the mean popularity
      ___
  }
)

# See the result
mean_popularity_2000_samp
Editează și rulează codul