使用 recipes 移除相关的预测变量
从训练集和测试集中移除彼此高度相关的预测变量,是特征工程中的关键一步,可确保模型拟合尽可能顺畅。
既然您已经发现 monthly_charges 与 avg_data_gb 高度相关,接下来需要在电信数据的特征工程流水线中,使用 step_corr() 添加相关性筛选。
本练习中,您将创建一个 recipe 对象,用于从电信数据中移除相关的预测变量。
telecom_training 和 telecom_test 数据集已加载到您的会话中。
本练习是课程的一部分
在 R 中使用 tidymodels 建模
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Specify a recipe object
telecom_cor_rec <- recipe(___,
data = ___) %>%
# Remove correlated variables
___(___, threshold = ___)