Trenowanie Naive Bayes z selekcją cech
Teraz ponownie uruchomisz model klasyfikacji tekstu Naive Bayes, który uruchomiłeś na końcu rozdziału 3, korzystając z wyborów dokonanych w poprzednim ćwiczeniu: kolumn title i category_desc ze zbioru danych volunteer.
To ćwiczenie jest częścią kursu
Preprocessing w uczeniu maszynowym w Pythonie
Instrukcje do ćwiczenia
- Użyj
train_test_split()na wektorze tekstowymfiltered_text, etykietachy(czyli etykietachcategory_desc) i przekaż zbiórydo parametrustratify, ponieważ mamy nierównomierny rozkład klas. - Dopasuj model Naive Bayes
nbdoX_trainiy_train. - Oblicz dokładność modelu
nbna zbiorze testowym.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)
# Fit the model to the training data
nb.____
# Print out the model's accuracy
print(nb.____)