Huấn luyện Naive Bayes với chọn lọc đặc trưng
Giờ bạn sẽ chạy lại mô hình phân loại văn bản Naive Bayes mà bạn đã thực hiện ở cuối Chương 3, với các lựa chọn đặc trưng từ bài trước: hai cột title và category_desc của tập dữ liệu volunteer.
Bài tập này là một phần của khóa học
Tiền xử lý cho Machine Learning bằng Python
Hướng dẫn bài tập
- Dùng
train_test_split()trên vector văn bảnfiltered_text, nhãny(chính là nhãncategory_desc), và truyền tậpyvào tham sốstratify, vì chúng ta có phân bố lớp không đều. - Fit mô hình Naive Bayes
nbvớiX_trainvày_train. - Tính độ chính xác trên tập kiểm tra của
nb.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)
# Fit the model to the training data
nb.____
# Print out the model's accuracy
print(nb.____)