Prédire les probabilités des critiques de films
Dans cet exercice, vous allez construire une régression logistique à partir du jeu de données movies. Les étiquettes sont stockées dans le tableau y et les caractéristiques dans X.
Entraînez le modèle sur les données d'entraînement. Au lieu de prédire des classes, prédisez les probabilités que chaque observation de l'ensemble de test appartienne à chacune des deux classes.
La régression logistique et les fonctions de séparation entraînement/test ont été importées pour vous.
Cette activité fait partie du cours
Analyse de sentiment en Python
Instructions de l’exercice
- Séparez les données en ensembles d'entraînement et de test.
- Entraînez un modèle de régression logistique.
- Prédisez les probabilités pour la classe 0 et pour la classe 1 sur les données de test. La classe 0 correspond à la première colonne des probabilités prédites, et la classe 1 à la deuxième.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)
# Train a logistic regression
log_reg = ____.____
# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]
print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])