Bắt đầu ngayBắt đầu miễn phí

Cây quyết định bị giới hạn và không bị giới hạn

Trong bài này, chúng ta sẽ quay lại bộ dữ liệu Pokémon từ chương trước. Nhắc lại: mục tiêu là dự đoán một Pokémon bất kỳ có phải là huyền thoại (legendary) hay không.

Ở đây, bạn sẽ xây dựng hai mô hình phân loại bằng cây quyết định. Ở mô hình thứ nhất, bạn chỉ định các tham số min_samples_leafmin_samples_split, nhưng không giới hạn độ sâu tối đa, để cây có thể phát triển hoàn toàn không bị ràng buộc.

Ở mô hình thứ hai, bạn sẽ áp đặt một số ràng buộc bằng cách giới hạn độ sâu của cây quyết định. Bằng cách so sánh hai mô hình, bạn sẽ hiểu rõ hơn khái niệm về một bộ học "yếu" (weak learner).

Bài tập này là một phần của khóa học

Ensemble Methods in Python

Xem khóa học

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Build unrestricted decision tree
clf = ____
clf.fit(X_train, y_train)

# Predict the labels
pred = clf.predict(X_test)

# Print the confusion matrix
cm = confusion_matrix(y_test, pred)
print('Confusion matrix:\n', cm)

# Print the F1 score
score = f1_score(y_test, pred)
print('F1-Score: {:.3f}'.format(score))
Chỉnh sửa và Chạy Mã