PCA trong pipeline mô hình
Bạn vừa thấy rằng các Pokemon huyền thoại thường có chỉ số tổng thể cao hơn. Hãy thử thêm một bộ phân loại vào pipeline để phát hiện Pokemon huyền thoại so với không huyền thoại dựa trên các thành phần chính.
Dữ liệu đã được nạp sẵn và tách thành tập huấn luyện và kiểm tra: X_train, X_test, y_train, y_test.
Tương tự, mọi gói và lớp liên quan (Pipeline(), StandardScaler(), PCA(), RandomForestClassifier()) cũng đã sẵn sàng.
Bài tập này là một phần của khóa học
Giảm Chiều Dữ Liệu với Python
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Build the pipeline
pipe = Pipeline([
('scaler', ____),
('reducer', ____),
('classifier', ____)])