Zacznij terazZacznij za darmo

Trenowanie Naive Bayes z selekcją cech

Teraz ponownie uruchomisz model klasyfikacji tekstu Naive Bayes, który uruchomiłeś na końcu rozdziału 3, korzystając z wyborów dokonanych w poprzednim ćwiczeniu: kolumn title i category_desc ze zbioru danych volunteer.

To ćwiczenie jest częścią kursu

Preprocessing w uczeniu maszynowym w Pythonie

Zobacz kurs

Instrukcje do ćwiczenia

  • Użyj train_test_split() na wektorze tekstowym filtered_text, etykietach y (czyli etykietach category_desc) i przekaż zbiór y do parametru stratify, ponieważ mamy nierównomierny rozkład klas.
  • Dopasuj model Naive Bayes nb do X_train i y_train.
  • Oblicz dokładność modelu nb na zbiorze testowym.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)

# Fit the model to the training data
nb.____

# Print out the model's accuracy
print(nb.____)
Edytuj i uruchom kod