在模型流水线中使用 PCA
我们刚刚看到,传说中的宝可梦整体属性通常更高。现在尝试在流水线中加入一个分类器,基于主成分来区分传说与非传说宝可梦。
数据已为您预加载并拆分为训练集与测试集:X_train、X_test、y_train、y_test。
相关的包与类也已就绪(Pipeline()、StandardScaler()、PCA()、RandomForestClassifier())。
本练习是课程的一部分
Python 中的降维
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Build the pipeline
pipe = Pipeline([
('scaler', ____),
('reducer', ____),
('classifier', ____)])