Nulové výběrové rozdělení směrnice
V předchozí kapitole jsi zkoumal/a výběrové rozdělení směrnice z populace, kde směrnice nabývala nenulové hodnoty. Při inferenci ale většinou potřebuješ znát výběrové rozdělení směrnice za předpokladu, že mezi vysvětlující a odezvovou proměnnou neexistuje žádný vztah. Navíc v praxi zpravidla neznáš populaci, ze které data pocházejí – nulové výběrové rozdělení proto musíš odvodit výhradně z původního datasetu.
V polovině 20. století bylo provedeno výzkumné šetření, které sledovalo jednovaječná dvojčata odloučená po narození: jedno dítě vyrůstalo u biologických rodičů a druhé v náhradní rodině. Cílem bylo zjistit, zda je inteligence výsledkem přírody, nebo výchovy – obě děti proto absolvovaly IQ testy. Data obsahují IQ skóre dvojčat vychovaných v náhradní rodině (Foster jako odezvová proměnná) a IQ skóre jejich biologických sourozenců (Biological jako vysvětlující proměnná).
V tomto cvičení použiješ funkci pull(). Ta přijme datový rámec a vrátí vybraný sloupec jako vektor (podobně jako operátor $).
Toto cvičení je součástí kurzu
Inference for Linear Regression in R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
library(infer)
# Calculate the observed slope
# Run a lin. reg. of Foster vs. Biological on the twins data
obs_slope <- ___(___, ___) %>%
# Tidy the result
___() %>%
# Filter for rows where term equal Biological
___(___) %>%
# Pull out the estimate column
___(___)
# See the result
obs_slope