Generování bootstrap distribuce
Postup pro generování bootstrap distribuce je podobný postupu pro generování výběrového rozdělení – liší se pouze první krok.
Pro vytvoření výběrového rozdělení vycházíš z populace a vzorkuješ bez opakování. Pro vytvoření bootstrap distribuce vycházíš z výběru a vzorkuješ ho s opakováním. Dál jsou kroky stejné: spočítáš souhrnnou statistiku, která tě zajímá, pro daný výběr nebo resample, a celý proces mnohokrát zopakovíš. V obou případech můžeš distribuci vizualizovat pomocí histogramu.
Zde je spotify_sample podmnožina datasetu spotify_population. Aby bylo snadnější pochopit, jak resampling funguje, byl přidán sloupec s indexem řádků nazvaný 'index' a zahrnuty byly pouze sloupce s názvem interpreta, názvem skladby a hodnotou danceability.
spotify_sample je k dispozici; pandas, numpy a matplotlib.pyplot jsou načteny pod svými obvyklými aliasy.
Toto cvičení je součástí kurzu
Vzorkování v Pythonu
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Generate 1 bootstrap resample
spotify_1_resample = ____
# Print the resample
print(spotify_1_resample)