Chọn đặc trưng dựa trên độ quan trọng của đặc trưng
Trong bài tập trước, bạn đã luyện tập cách các phương pháp filter và wrapper hữu ích khi chọn đặc trưng trong Machine Learning, cũng như trong phỏng vấn Machine Learning. Trong bài này, bạn sẽ luyện tập các phương pháp chọn đặc trưng bằng cách sử dụng độ quan trọng đặc trưng tích hợp sẵn trong các thuật toán Machine Learning dựa trên cây trên DataFrame diabetes.
Mặc dù trên DataCamp chỉ có thời gian và không gian để thực hành với một vài phương pháp, nhưng trên trang web của scikit-learn có tài liệu rất tốt giới thiệu nhiều cách khác để chọn đặc trưng.
Ma trận đặc trưng và mảng mục tiêu đã được lưu trong không gian làm việc của bạn lần lượt là X và y.
Hãy nhớ rằng chọn đặc trưng được xem là một bước tiền xử lý:

Bài tập này là một phần của khóa học
Luyện tập câu hỏi phỏng vấn Machine Learning bằng Python
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Import
from sklearn.ensemble import ____
# Instantiate
rf_mod = ____(max_depth=2, random_state=123,
n_estimators=100, oob_score=True)
# Fit
rf_mod.____(____, ____)
# Print
print(diabetes.columns)
print(rf_mod.____)