Porovnávání modelů
Vybrat nejlepší model z několika konkurujících si alternativ může být složité, pokud jsou tyto modely postavené na nekompletních datech. V tomto cvičení rozšíříš model, který jsi sestavil/a dříve, o další vysvětlující proměnnou: rasu hlavní postavy biografického filmu. Pak se pokusíš oba modely porovnat.
Pro připomenutí, takto jsi natrénoval/a první model:
model_1 <- lm(earnings ~ country + year + sub_type,
data = biopics)
Podívejme se, jestli přidání proměnné pro rasu model zlepšilo!
Toto cvičení je součástí kurzu
Práce s chybějícími daty pomocí imputace v R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Fit linear regression to predict earnings
model_2 <- ___(___,
___ = ___)