Zacznij terazZacznij za darmo

Rozkład próbkowania a rozkład bootstrapowy

Rozkład próbkowania i rozkład bootstrapowy są ze sobą ściśle powiązane. W sytuacjach, gdy możesz wielokrotnie pobierać próbki z populacji (co w praktyce zdarza się rzadko), warto wygenerować oba rozkłady – jeden po drugim – żeby zobaczyć, jak się do siebie odnoszą.

Statystyka, która cię interesuje, to średni wynik popularity dla piosenek.

Dostępne są: spotify_population (cały zbiór danych) oraz spotify_sample (500 wierszy reprezentujących oryginalną próbę); załadowana jest biblioteka dplyr.

To ćwiczenie jest częścią kursu

Próbkowanie w R

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Generate a sampling distribution
mean_popularity_2000_samp <- ___(
  # Use 2000 replicates
  ___,
  expr = {
    # Start with the population
    ___ %>% 
      # Sample 500 rows without replacement
      ___ %>% 
      # Calculate the mean popularity as mean_popularity
      ___ %>% 
      # Pull out the mean popularity
      ___
  }
)

# See the result
mean_popularity_2000_samp
Edytuj i uruchom kod