Vyhodnocení a porovnání imputací
Při sestavování imputačního modelu je dobré porovnat ho s jiným přístupem. V této lekci porovnáš dříve vytvořený dataset imputovaný pomocí impute_lm() s datasetem imputovaným průměrem. Oba tyto datasety jsou v cvičení k dispozici jako ocean_imp_lm_wind a ocean_imp_mean.
Toto cvičení je součástí kurzu
Práce s chybějícími daty v R
Pokyny k cvičení
- Spoj modely dohromady pomocí
bind_rows()tak, aby modelocean_imp_meanbyl přiřazen domeanaocean_imp_lm_winddolm_wind. - Zobraz hodnoty
air_tempahumidityjako bodový graf – umístiair_temp_cna osu x,humidityna osu y, obarvi chybějící hodnoty a rozděl graf podle použitého imputačního modelu (imp_model).
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Bind the models together
bound_models <- bind_rows(mean = ___,
lm_wind = ___,
.id = "imp_model")
# Inspect the values of air_temp and humidity as a scatter plot
ggplot(___,
aes(x = ___,
y = ___,
color = any_missing)) +
geom_point() +
facet_wrap(~___)