Začněte nyníZačněte zdarma

Trénování Naive Bayes s výběrem příznaků

Teď znovu spustíš model textové klasifikace Naive Bayes, který jsi použil/a na konci 3. kapitoly, tentokrát s výběrem příznaků z předchozího cvičení: sloupci title a category_desc z datasetu volunteer.

Toto cvičení je součástí kurzu

Preprocessing pro Machine Learning v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Použij train_test_split() na textový vektor filtered_text, štítky y (tedy štítky category_desc) a předej sadu y parametru stratify, protože máme nerovnoměrné rozložení tříd.
  • Natrénuj model Naive Bayes nb na X_train a y_train.
  • Vypočítej přesnost modelu nb na testovací sadě.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)

# Fit the model to the training data
nb.____

# Print out the model's accuracy
print(nb.____)
Upravit a spustit kód