CommencezCommencez gratuitement

Repérer les mots les plus positifs et les plus négatifs

Dans cet exercice, nous allons interpréter les coefficients d'une régression logistique entraînée sur l'ensemble de données de sentiment de critiques de films. L'objet du modèle est déjà instancié et entraîné pour vous dans la variable lr.

De plus, les mots correspondant aux différentes caractéristiques sont chargés dans la variable vocab. Par exemple, puisque vocab[100] vaut « think », cela signifie que la caractéristique 100 correspond au nombre de fois où le mot « think » apparaît dans cette critique de film.

Cette activité fait partie du cours

Classificateurs linéaires en Python

Voir le cours

Instructions de l’exercice

  • Trouvez les mots correspondant aux 5 plus grands coefficients.
  • Trouvez les mots correspondant aux 5 plus petits coefficients.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Get the indices of the sorted cofficients
inds_ascending = np.argsort(lr.coef_.flatten()) 
inds_descending = inds_ascending[::-1]

# Print the most positive words
print("Most positive words: ", end="")
for i in range(5):
    print(____, end=", ")
print("\n")

# Print most negative words
print("Most negative words: ", end="")
for i in range(5):
    print(____, end=", ")
print("\n")
Modifier et exécuter le code