Kom igångKom igång gratis

Förutsäg sannolikheter för filmrecensioner

I den här övningen bygger du en logistisk regression med datamängden movies. Etiketterna finns lagrade i arrayen y och särdragen i X.

Träna modellen på träningsdatan. I stället för att förutsäga klasser ska du förutsäga sannolikheterna för att varje instans i testmängden tillhör var och en av de två klasserna.

Den logistiska regressionen och funktionerna för tränings- och testuppdelning har redan importerats åt dig.

Den här övningen är en del av kursen

Sentimentanalys i Python

Visa kurs

Övningsinstruktioner

  • Dela upp datan i en tränings- och en testmängd.
  • Träna en logistisk regressionsmodell.
  • Förutsäg sannolikheterna för klass 0 och klass 1 för testdatan. Klass 0 finns i den första kolumnen i de förutsagda sannolikheterna och klass 1 i den andra.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)

# Train a logistic regression
log_reg = ____.____

# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]

print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])
Redigera och kör kod