选择默认模型
MICE 会为数据中的每个变量各自创建一个插补模型。模型的类型取决于该变量的类型。一个常用的做法是为 4 种变量类型分别设置默认模型。
您可以通过向 mice() 传入 defaultMethod 参数来实现。它应为长度为 4 的向量,按顺序包含以下类型的默认插补方法:
- 连续变量,
- 二元变量,
- 类别变量(无序因子),
- 因子变量(有序因子)。
在本练习中,您将利用 mice 的文档查看可用方法列表,并选择算法要使用的方法。让我们来做一次模型选择!
本练习是课程的一部分
R 中的缺失值填补处理
练习说明
- 在
?mice返回的 RDocumentation 中,有一张表列出了每种方法对应的关键字。 - 使用
mice()对biopics数据进行插补,并按下列顺序指定默认方法:分类与回归树、线性判别分析、预测均值匹配、比例优势模型。 - 打印
biopics_multiimp,查看每个变量对应采用了哪种方法。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Impute biopics using the methods specified in the instruction
biopics_multiimp <- ___(biopics, m = 20,
defaultMethod = ___)
# Print biopics_multiimp
print(biopics_multiimp)