Pipeline dự đoán thể loại bài hát: II
Sau khi thiết lập các bước của pipeline ở bài trước, giờ bạn sẽ dùng nó trên tập dữ liệu music_df để phân loại thể loại bài hát. Điều làm cho pipeline cực kỳ hữu ích là giao diện sử dụng rất đơn giản.
X_train, X_test, y_train, và y_test đã được nạp sẵn cho bạn, và confusion_matrix đã được import từ sklearn.metrics.
Bài tập này là một phần của khóa học
Học có giám sát với scikit-learn
Hướng dẫn bài tập
- Tạo một pipeline bằng cách dùng các bước bạn đã định nghĩa trước đó.
- Fit pipeline lên dữ liệu huấn luyện.
- Tạo dự đoán trên tập kiểm thử.
- Tính và in ma trận nhầm lẫn.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
steps = [("imputer", imp_mean),
("knn", knn)]
# Create the pipeline
pipeline = ____(____)
# Fit the pipeline to the training data
____
# Make predictions on the test set
y_pred = ____
# Print the confusion matrix
print(____(____, ____))