Träna Naive Bayes med särdragsurval
Nu ska du köra om Naive Bayes-textklassificeringsmodellen som du körde i slutet av kapitel 3, med de urvalsbeslut du fattade i föregående övning: kolumnerna title och category_desc från datamängden volunteer.
Den här övningen är en del av kursen
Förbehandling för maskininlärning i Python
Övningsinstruktioner
- Använd
train_test_split()på textvektornfiltered_text, etiketternay(det vill säga etiketterna fråncategory_desc), och skickay-uppsättningen till parameternstratify, eftersom klassfördelningen är ojämn. - Anpassa Naive Bayes-modellen
nbtillX_trainochy_train. - Beräkna testmängdens noggrannhet för
nb.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)
# Fit the model to the training data
nb.____
# Print out the model's accuracy
print(nb.____)