Bắt đầu ngayBắt đầu miễn phí

Pipeline đầu tiên của bạn

Đồng nghiệp của bạn đã dùng AdaBoostClassifier cho bộ dữ liệu chấm điểm tín dụng. Bạn cũng muốn thử một mô hình phân loại random forest. Trong bài tập này, bạn sẽ fit mô hình này vào dữ liệu và so sánh với AdaBoostClassifier. Hãy nhớ tách dữ liệu train/test để tránh overfitting. Dữ liệu đã được nạp sẵn và biến đổi để tất cả đặc trưng đều là số. Các đặc trưng có trong X và nhãn trong y. Mô-đun RandomForestClassifier cũng đã được nạp sẵn.

Bài tập này là một phần của khóa học

Thiết kế quy trình Machine Learning bằng Python

Xem khóa học

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Split the data into train and test, with 20% as test
X_train, ____, ____, y_test = train_test_split(
  X, y, ____=0.2, random_state=1)
Chỉnh sửa và Chạy Mã