Rozkład próbkowania a rozkład bootstrapowy
Rozkład próbkowania i rozkład bootstrapowy są ze sobą ściśle powiązane. W sytuacjach, gdy możesz wielokrotnie pobierać próbki z populacji (co w praktyce zdarza się rzadko), warto wygenerować oba rozkłady – jeden po drugim – żeby zobaczyć, jak się do siebie odnoszą.
Statystyka, która cię interesuje, to średni wynik popularity dla piosenek.
Dostępne są: spotify_population (cały zbiór danych) oraz spotify_sample (500 wierszy reprezentujących oryginalną próbę); załadowana jest biblioteka dplyr.
To ćwiczenie jest częścią kursu
Próbkowanie w R
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Generate a sampling distribution
mean_popularity_2000_samp <- ___(
# Use 2000 replicates
___,
expr = {
# Start with the population
___ %>%
# Sample 500 rows without replacement
___ %>%
# Calculate the mean popularity as mean_popularity
___ %>%
# Pull out the mean popularity
___
}
)
# See the result
mean_popularity_2000_samp