Compararea modelelor
Alegerea celui mai bun model dintre mai multe variante concurente poate fi dificilă atunci când modelele sunt construite pe date incomplete. În acest exercițiu, vei extinde modelul construit anterior adăugând o variabilă explicativă în plus: rasa subiectului filmului. Apoi vei încerca să îl compari cu modelul anterior.
Ca reminder, acesta este modul în care ai ajustat primul model:
model_1 <- lm(earnings ~ country + year + sub_type,
data = biopics)
Hai să vedem dacă putem stabili dacă adăugarea variabilei sub_race îmbunătățește modelul!
Acest exercițiu face parte din cursul
Gestionarea datelor lipsă prin imputare în R
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Fit linear regression to predict earnings
model_2 <- ___(___,
___ = ___)