Trénování Naive Bayes s výběrem příznaků
Teď znovu spustíš model textové klasifikace Naive Bayes, který jsi použil/a na konci 3. kapitoly, tentokrát s výběrem příznaků z předchozího cvičení: sloupci title a category_desc z datasetu volunteer.
Toto cvičení je součástí kurzu
Preprocessing pro Machine Learning v Pythonu
Pokyny k cvičení
- Použij
train_test_split()na textový vektorfiltered_text, štítkyy(tedy štítkycategory_desc) a předej saduyparametrustratify, protože máme nerovnoměrné rozložení tříd. - Natrénuj model Naive Bayes
nbnaX_trainay_train. - Vypočítej přesnost modelu
nbna testovací sadě.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)
# Fit the model to the training data
nb.____
# Print out the model's accuracy
print(nb.____)