Antrenarea Naive Bayes cu selecție de caracteristici
Acum vei rula din nou modelul de clasificare a textului Naive Bayes pe care l-ai folosit la finalul Capitolului 3, de data aceasta cu opțiunile de selecție din exercițiul anterior: coloanele title și category_desc din setul de date volunteer.
Acest exercițiu face parte din cursul
Preprocesare pentru Machine Learning în Python
Instrucțiuni pentru exercițiu
- Aplică
train_test_split()pe vectorul de textfiltered_text, eticheteley(adică etichetelecategory_desc) și transmite setulyparametruluistratify, deoarece distribuția claselor este inegală. - Antrenează modelul Naive Bayes
nbpeX_trainșiy_train. - Calculează acuratețea modelului
nbpe setul de testare.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)
# Fit the model to the training data
nb.____
# Print out the model's accuracy
print(nb.____)