Interval spolehlivosti pomocí aproximace
Aproximační zkratka nabízí alternativní způsob popisu výběrového rozdělení. V tomto cvičení ji použiješ k sestavení intervalu spolehlivosti pro podíl respondentů žijících v pacifickém regionu.
Když sestavuješ jakýkoli interval spolehlivosti, potřebuješ tři složky: bodový odhad (zde p_hat), směrodatnou chybu (SE) a počet směrodatných chyb, které přičteš a odečteš. U výběrového rozdělení ve tvaru zvonu odpovídá přičtení a odečtení dvou SE hladině spolehlivosti 95 %. Při bootstrapu můžeš tvar rozdělení ověřit vizuálně – máš k dispozici bootstrapové rozdělení, které si zobrazíš. U aproximace to tak jednoduché není — nejsi sice úplně ve tmě, ale spoléháš na „pravidlo palce", které ti zaručí, že pracuješ s rozdělením ve tvaru zvonu.
Toto cvičení je součástí kurzu
Inference for Categorical Data in R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Calculate n as the number of rows
n <- nrow(gss2016)
# Calculate p_hat as the proportion in pacific meta region
p_hat <- gss2016 %>%
___(prop_pacific = ___(___ == "___")) %>%
pull()
# See the result
p_hat