Generování bootstrap distribuce
Postup pro generování bootstrap distribuce je nápadně podobný postupu pro generování výběrového rozdělení – liší se jen první krok.
Pro sestavení výběrového rozdělení začínáš s populací a vzorkuješ bez nahrazení. Pro sestavení bootstrap distribuce začínáš s výběrem a vzorkuješ ho s nahrazením. Dál jsou kroky stejné: vypočítáš souhrnnou statistiku, která tě zajímá, pro daný výběr nebo převzorkování, a celý postup mnohokrát zopakuješ. V obou případech můžeš výsledné rozdělení vizualizovat pomocí histogramu.
Zde je spotify_sample podmnožinou datasetu spotify_population. Aby bylo snáze vidět, jak převzorkování funguje, byl přidán sloupec s ID řádku a ponechány pouze sloupce s názvem interpreta, názvem skladby a hodnotou danceability.
spotify_sample je k dispozici; dplyr a ggplot2 jsou načteny.
Toto cvičení je součástí kurzu
Vzorkování v R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Generate 1 bootstrap resample
spotify_1_resample <- ___
# See the result
spotify_1_resample