Comparer des modèles
Choisir le meilleur modèle parmi plusieurs modèles concurrents peut être ardu lorsque ces modèles sont bâtis à partir de données incomplètes. Dans cet exercice, vous allez reprendre le modèle créé précédemment en y ajoutant une variable explicative de plus : la race du sujet du film. Ensuite, vous tenterez de le comparer au modèle précédent.
Rappel : voici comment vous avez ajusté le premier modèle :
model_1 <- lm(earnings ~ country + year + sub_type,
data = biopics)
Voyons si l'ajout de la variable de race améliore le modèle !
Cette activité fait partie du cours
Traitement des données manquantes par imputation dans R
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Fit linear regression to predict earnings
model_2 <- ___(___,
___ = ___)