Výběr výchozích modelů
MICE vytváří pro každou proměnnou v datech samostatný imputační model. Typ modelu závisí na typu dané proměnné. Oblíbeným způsobem, jak určit, jaké modely chceme použít, je nastavit výchozí model pro každý ze čtyř typů proměnných.
To uděláš předáním argumentu defaultMethod do mice(), který by měl být vektor délky 4 obsahující výchozí imputační metody pro:
- Spojité proměnné,
- Binární proměnné,
- Kategorické proměnné (neuspořádané faktory),
- Faktorové proměnné (uspořádané faktory).
V tomto cvičení využiješ dokumentaci mice k zobrazení seznamu dostupných metod a výběru těch, které má algoritmus použít. Pojďme vybrat správné modely!
Toto cvičení je součástí kurzu
Práce s chybějícími daty pomocí imputace v R
Pokyny k cvičení
- V dokumentaci zobrazené příkazem
?micenajdeš tabulku s klíčovým slovem pro každou metodu. - Imputuj data
biopicspomocímice()s těmito výchozími metodami (v uvedeném pořadí): klasifikační a regresní stromy, lineární diskriminantní analýza, predictive mean matching, proportional odds model. - Vypiš
biopics_multiimp, abys viděl/a, která metoda byla použita pro kterou proměnnou.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Impute biopics using the methods specified in the instruction
biopics_multiimp <- ___(biopics, m = 20,
defaultMethod = ___)
# Print biopics_multiimp
print(biopics_multiimp)