CommencezCommencez gratuitement

Prédire les probabilités des critiques de films

Dans cet exercice, vous allez construire une régression logistique à partir du jeu de données movies. Les étiquettes sont stockées dans le tableau y et les caractéristiques dans X.

Entraînez le modèle sur les données d'entraînement. Au lieu de prédire des classes, prédisez les probabilités que chaque observation de l'ensemble de test appartienne à chacune des deux classes.

La régression logistique et les fonctions de séparation entraînement/test ont été importées pour vous.

Cette activité fait partie du cours

Analyse de sentiment en Python

Voir le cours

Instructions de l’exercice

  • Séparez les données en ensembles d'entraînement et de test.
  • Entraînez un modèle de régression logistique.
  • Prédisez les probabilités pour la classe 0 et pour la classe 1 sur les données de test. La classe 0 correspond à la première colonne des probabilités prédites, et la classe 1 à la deuxième.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)

# Train a logistic regression
log_reg = ____.____

# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]

print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])
Modifier et exécuter le code