Aan de slagBegin gratis

Nul-steekproevenverdeling van de helling

In het vorige hoofdstuk heb je de steekproevenverdeling van de helling onderzocht voor een populatie waarin de helling niet nul was. Voor inferentie heb je echter meestal de steekproevenverdeling van de helling nodig onder de hypothese dat er geen relatie is tussen de verklarende en de responsvariabele. Bovendien ken je in de meeste situaties de populatie waaruit de data afkomstig is niet, dus moet de nul-steekproevenverdeling worden afgeleid op basis van alleen de oorspronkelijke gegevensset.

Halverwege de 20e eeuw is een onderzoek uitgevoerd waarin identieke tweelingen werden opgespoord die bij de geboorte waren gescheiden: één kind groeide op bij de biologische ouders en het andere in een pleeggezin. Om te onderzoeken of intelligentie vooral door aanleg of door omgeving wordt bepaald, kregen beide kinderen een IQ-test. De resulterende data bevatten de IQ's van de pleegtweelingen (Foster is de responsvariabele) en de IQ's van de biologische tweelingen (Biological is de verklarende variabele).

In deze oefening gebruik je de functie pull(). Deze functie neemt een data frame en geeft een geselecteerde kolom terug als een vector (vergelijkbaar met $).

Deze oefening maakt deel uit van de cursus

Inferentie voor lineaire regressie in R

Bekijk cursus

Interactieve oefening met praktijkervaring

Probeer deze oefening door deze voorbeeldcode aan te vullen.

library(infer)

# Calculate the observed slope
# Run a lin. reg. of Foster vs. Biological on the twins data
obs_slope <- ___(___, ___) %>%
  # Tidy the result
  ___() %>%   
  # Filter for rows where term equal Biological
  ___(___) %>%
  # Pull out the estimate column
  ___(___) 

# See the result
obs_slope
Code bewerken en uitvoeren