N-grammes d'ordre supérieur pour l'analyse de sentiment
Comme dans un exercice précédent, nous allons créer un classificateur capable de détecter si la critique d'un film est positive ou négative. Cette fois-ci, toutefois, nous utiliserons des n-grammes jusqu'à n=2 pour réaliser la tâche.
Les critiques d'entraînement avec n-grammes sont disponibles dans X_train_ng. Les critiques de test correspondantes sont dans X_test_ng. Enfin, utilisez y_train et y_test pour accéder respectivement aux classes de sentiment d'entraînement et de test.
Cette activité fait partie du cours
Ingénierie des caractéristiques pour le NLP en Python
Instructions de l’exercice
- Définissez une instance de MultinomialNB. Nommez-la
clf_ng. - Entraînez le classificateur sur
X_train_ngety_trainavecfit(). - Mesurez la
accuracysurX_test_ngety_testà l'aide de la méthodescore().
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Define an instance of MultinomialNB
clf_ng = ____
# Fit the classifier
clf_ng.____(____, ____)
# Measure the accuracy
accuracy = ____
print("The accuracy of the classifier on the test set is %.3f" % accuracy)
# Predict the sentiment of a negative review
review = "The movie was not good. The plot had several holes and the acting lacked panache."
prediction = clf_ng.predict(ng_vectorizer.transform([review]))[0]
print("The sentiment predicted by the classifier is %i" % (prediction))