選擇預設模型
MICE 會為資料中的每個變數建立各自的插補模型。模型的種類取決於該變數的型別。常見的做法是,為四種變數型別各設定一個預設模型。
你可以透過將 defaultMethod 參數傳給 mice() 來完成,該參數應為長度為 4 的向量,依序包含以下情況的預設插補方法:
- 連續變數,
- 二元變數,
- 類別變數(無序因子),
- 因子變數(有序因子)。
在這個練習中,你將利用 mice 的文件來查看可用方法的清單,並挑選演算法要使用的合適方法。開始做模型選擇吧!
本練習屬於課程
在 R 中以插補處理遺漏值
練習說明
- 在
?mice回傳的 RDocumentation 裡,有一個表格列出每個方法對應的關鍵字。 - 使用
mice()對biopics資料進行插補,並依序使用以下預設方法:分類與迴歸樹、線性判別分析、預測平均匹配、比例勝算模型。 - 列印
biopics_multiimp,查看各變數實際使用了哪一種方法。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Impute biopics using the methods specified in the instruction
biopics_multiimp <- ___(biopics, m = 20,
defaultMethod = ___)
# Print biopics_multiimp
print(biopics_multiimp)