您的第一个管道
您的同事在信用评分数据集上使用了 AdaBoostClassifier。您也想尝试随机森林分类器。本练习中,您将把该分类器拟合到数据上,并与 AdaBoostClassifier 进行比较。请务必使用训练/测试数据划分来避免过拟合。数据已预加载并转换为数值型特征。特征为 X,标签为 y。模块 RandomForestClassifier 也已预加载。
本练习是课程的一部分
用 Python 设计机器学习工作流
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Split the data into train and test, with 20% as test
X_train, ____, ____, y_test = train_test_split(
X, y, ____=0.2, random_state=1)