Évaluer et comparer les imputations
Lorsque vous construisez un modèle d'imputation, il est judicieux de le comparer à une autre méthode. Dans cette leçon, nous allons comparer le jeu de données imputé précédemment avec impute_lm() à celui imputé par la moyenne. Ces deux jeux de données sont fournis dans cet exercice sous les noms ocean_imp_lm_wind et ocean_imp_mean respectivement.
Cet exercice fait partie du cours
<cours>Gérer les données manquantes en R</cours>Instructions de l’exercice
- Regroupez les modèles avec
bind_rows(), en plaçant le modèleocean_imp_meandansmeanetocean_imp_lm_winddanslm_wind. - Représentez
air_tempethumidityen nuage de points, avecair_temp_csur l’axe des x,humiditysur l’axe des y, une couleur indiquant les valeurs manquantes, et des panneaux selon le modèle d’imputation utilisé (imp_model).
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Bind the models together
bound_models <- bind_rows(mean = ___,
lm_wind = ___,
.id = "imp_model")
# Inspect the values of air_temp and humidity as a scatter plot
ggplot(___,
aes(x = ___,
y = ___,
color = any_missing)) +
geom_point() +
facet_wrap(~___)