Kom igångKom igång gratis

Nollfördelning för lutningsparametern

I det föregående kapitlet undersökte du samplingfördelningen för lutningen från en population där lutningen skilde sig från noll. För att genomföra inferens behöver du dock vanligtvis känna till samplingfördelningen för lutningen under hypotesen att det inte finns något samband mellan förklaringsvariabeln och responsvariabeln. Dessutom känner du i de flesta fall inte till den population som datan kommer från, vilket innebär att nollfördelningen måste härledas enbart från det ursprungliga datasetet.

I mitten av 1900-talet genomfördes en studie där man spårade upp enäggstvillingar som separerats vid födseln: ett barn uppfostrades hos sina biologiska föräldrar och det andra i ett fosterhem. I ett försök att besvara frågan om intelligens är ett resultat av arv eller miljö fick båda barnen genomgå IQ-tester. De resulterande data visar IQ-värdena för fostertvillingarna (Foster är responsvariabeln) och de biologiska tvillingarna (Biological är förklaringsvariabeln).

I den här övningen använder du funktionen pull(). Den tar en dataram och returnerar en vald kolumn som en vektor (liknande $).

Den här övningen är en del av kursen

Inferens för linjär regression i R

Visa kurs

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

library(infer)

# Calculate the observed slope
# Run a lin. reg. of Foster vs. Biological on the twins data
obs_slope <- ___(___, ___) %>%
  # Tidy the result
  ___() %>%   
  # Filter for rows where term equal Biological
  ___(___) %>%
  # Pull out the estimate column
  ___(___) 

# See the result
obs_slope
Redigera och kör kod