Pipeline đầu tiên của bạn
Đồng nghiệp của bạn đã dùng AdaBoostClassifier cho bộ dữ liệu chấm điểm tín dụng. Bạn cũng muốn thử một mô hình phân loại random forest. Trong bài tập này, bạn sẽ fit mô hình này vào dữ liệu và so sánh với AdaBoostClassifier. Hãy nhớ tách dữ liệu train/test để tránh overfitting. Dữ liệu đã được nạp sẵn và biến đổi để tất cả đặc trưng đều là số. Các đặc trưng có trong X và nhãn trong y. Mô-đun RandomForestClassifier cũng đã được nạp sẵn.
Bài tập này là một phần của khóa học
Thiết kế quy trình Machine Learning bằng Python
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Split the data into train and test, with 20% as test
X_train, ____, ____, y_test = train_test_split(
X, y, ____=0.2, random_state=1)