ÎncepețiÎncepe gratuit

Antrenarea Naive Bayes cu selecție de caracteristici

Acum vei rula din nou modelul de clasificare a textului Naive Bayes pe care l-ai folosit la finalul Capitolului 3, de data aceasta cu opțiunile de selecție din exercițiul anterior: coloanele title și category_desc din setul de date volunteer.

Acest exercițiu face parte din cursul

Preprocesare pentru Machine Learning în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Aplică train_test_split() pe vectorul de text filtered_text, etichetele y (adică etichetele category_desc) și transmite setul y parametrului stratify, deoarece distribuția claselor este inegală.
  • Antrenează modelul Naive Bayes nb pe X_train și y_train.
  • Calculează acuratețea modelului nb pe setul de testare.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)

# Fit the model to the training data
nb.____

# Print out the model's accuracy
print(nb.____)
Editează și rulează codul