Sestrojení intervalu spolehlivosti
Viděl/a jsi jeden příklad toho, jak se může p-hat měnit při resamplingu, ale abychom dobře odhadli jeho variabilitu, musíme tento postup zopakovat mnohokrát. Zde sestavíš celé bootstrapové rozdělení pro odhad směrodatné chyby (SE), která poslouží k vytvoření intervalu spolehlivosti. K zefektivnění výpočtu statistik z mnoha datových sad využiješ další funkci z balíčku infer: calculate().
Chvíli si prohlédni výstup funkce calculate(). Tato funkce zredukuje tvůj datový rámec na pouhé dva sloupce: jeden pro hodnoty "stat" a druhý pro příslušný "replicate".
Až si bootstrapové rozdělení zobrazíš, zjistíš, že má tvar zvonu. Právě tento tvar ti umožňuje přičíst a odečíst dvě SE a získat tak 95% interval.
Toto cvičení je součástí kurzu
Inference for Categorical Data in R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Create bootstrap distribution for proportion with High conf
boot_dist <- gss2016 %>%
# Specify the response and success
specify(response = ___, ___ = "___") %>%
# Generate 500 bootstrap reps
generate(___ = ___, type = "bootstrap") %>%
# Calculate proportions
calculate(stat = "___")
# See the result
boot_dist