Нулевое выборочное распределение наклона
В предыдущей главе вы изучали выборочное распределение наклона для генеральной совокупности, в которой наклон был ненулевым. Однако для проведения статистического вывода, как правило, необходимо знать выборочное распределение наклона при условии нулевой гипотезы — то есть когда между объясняющей переменной и переменной отклика нет никакой связи. Кроме того, в большинстве случаев генеральная совокупность, из которой получены данные, неизвестна, поэтому нулевое выборочное распределение приходится строить исключительно на основе исходного набора данных.
В середине XX века было проведено исследование, в котором учёные разыскали однояйцевых близнецов, разлучённых при рождении: один ребёнок воспитывался в семье биологических родителей, другой — в приёмной семье. Чтобы выяснить, что определяет интеллект — природа или воспитание, — обоим детям провели тесты IQ. Полученные данные содержат показатели IQ приёмных близнецов (Foster — переменная отклика) и биологических близнецов (Biological — объясняющая переменная).
В этом упражнении вы будете использовать функцию pull(). Она принимает фрейм данных и возвращает выбранный столбец в виде вектора (аналогично оператору $).
Это упражнение является частью курса
Вывод для линейной регрессии в R
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
library(infer)
# Calculate the observed slope
# Run a lin. reg. of Foster vs. Biological on the twins data
obs_slope <- ___(___, ___) %>%
# Tidy the result
___() %>%
# Filter for rows where term equal Biological
___(___) %>%
# Pull out the estimate column
___(___)
# See the result
obs_slope