CommencezCommencez gratuitement

Entraîner Naive Bayes avec sélection de caractéristiques

Vous allez maintenant relancer le modèle de classification de texte Naive Bayes utilisé à la fin du chapitre 3, en appliquant nos choix de sélection de l'exercice précédent : les colonnes title et category_desc de l'ensemble de données volunteer.

Cette activité fait partie du cours

Prétraitement pour le Machine Learning en Python

Voir le cours

Instructions de l’exercice

  • Utilisez train_test_split() sur le vecteur de texte filtered_text, les étiquettes y (qui correspondent aux étiquettes category_desc), et passez l'ensemble y au paramètre stratify, puisque la distribution des classes est inégale.
  • Ajustez le modèle Naive Bayes nb sur X_train et y_train.
  • Calculez la précision sur l'ensemble de test de nb.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Split the dataset according to the class distribution of category_desc
X_train, X_test, y_train, y_test = ____(____.toarray(), ____, stratify=____, random_state=42)

# Fit the model to the training data
nb.____

# Print out the model's accuracy
print(nb.____)
Modifier et exécuter le code