Bắt đầu ngayBắt đầu miễn phí

Huấn luyện Naive Bayes với chọn lọc đặc trưng

Giờ bạn sẽ chạy lại mô hình phân loại văn bản Naive Bayes mà bạn đã thực hiện ở cuối Chương 3, với các lựa chọn đặc trưng từ bài trước: hai cột titlecategory_desc của tập dữ liệu volunteer.

Bài tập này là một phần của khóa học

Tiền xử lý cho Machine Learning bằng Python

Xem khóa học

Hướng dẫn bài tập

  • Dùng train_test_split() trên vector văn bản filtered_text, nhãn y (chính là nhãn category_desc), và truyền tập y vào tham số stratify, vì chúng ta có phân bố lớp không đều.
  • Fit mô hình Naive Bayes nb với X_trainy_train.
  • Tính độ chính xác trên tập kiểm tra của nb.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)

# Fit the model to the training data
nb.____

# Print out the model's accuracy
print(nb.____)
Chỉnh sửa và Chạy Mã