Začněte nyníZačněte zdarma

Sestrojení intervalu spolehlivosti

Viděl/a jsi jeden příklad toho, jak se může p-hat měnit při resamplingu, ale abychom dobře odhadli jeho variabilitu, musíme tento postup zopakovat mnohokrát. Zde sestavíš celé bootstrapové rozdělení pro odhad směrodatné chyby (SE), která poslouží k vytvoření intervalu spolehlivosti. K zefektivnění výpočtu statistik z mnoha datových sad využiješ další funkci z balíčku infer: calculate().

Chvíli si prohlédni výstup funkce calculate(). Tato funkce zredukuje tvůj datový rámec na pouhé dva sloupce: jeden pro hodnoty "stat" a druhý pro příslušný "replicate".

Až si bootstrapové rozdělení zobrazíš, zjistíš, že má tvar zvonu. Právě tento tvar ti umožňuje přičíst a odečíst dvě SE a získat tak 95% interval.

Toto cvičení je součástí kurzu

Inference for Categorical Data in R

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Create bootstrap distribution for proportion with High conf
boot_dist <- gss2016 %>%
  # Specify the response and success
  specify(response = ___, ___ = "___") %>%
  # Generate 500 bootstrap reps
  generate(___ = ___, type = "bootstrap") %>%
  # Calculate proportions
  calculate(stat = "___")

# See the result
boot_dist
Upravit a spustit kód