Kom igångKom igång gratis

Träna Naive Bayes med särdragsurval

Nu ska du köra om Naive Bayes-textklassificeringsmodellen som du körde i slutet av kapitel 3, med de urvalsbeslut du fattade i föregående övning: kolumnerna title och category_desc från datamängden volunteer.

Den här övningen är en del av kursen

Förbehandling för maskininlärning i Python

Visa kurs

Övningsinstruktioner

  • Använd train_test_split() på textvektorn filtered_text, etiketterna y (det vill säga etiketterna från category_desc), och skicka y-uppsättningen till parametern stratify, eftersom klassfördelningen är ojämn.
  • Anpassa Naive Bayes-modellen nb till X_train och y_train.
  • Beräkna testmängdens noggrannhet för nb.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)

# Fit the model to the training data
nb.____

# Print out the model's accuracy
print(nb.____)
Redigera och kör kod