Začněte nyníZačněte zdarma

Předpověď pravděpodobností u filmových recenzí

V tomto cvičení sestavíš logistickou regresi na základě datasetu movies. Štítky jsou uloženy v poli y a příznaky v X.

Natrénuj model na trénovacích datech. Místo předpovídání tříd předpověz pravděpodobnosti, s jakou každá instance v testovací množině patří do jedné ze dvou tříd.

Funkce pro logistickou regresi a rozdělení dat na trénovací a testovací množinu jsou již naimportované.

Toto cvičení je součástí kurzu

Sentiment Analysis v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Rozděl data na trénovací a testovací množinu.
  • Natrénuj model logistické regrese.
  • Předpověz pravděpodobnosti pro třídu 0 a pro třídu 1 z testovacích dat. Třída 0 se nachází v prvním sloupci předpovězených pravděpodobností, třída 1 ve druhém.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)

# Train a logistic regression
log_reg = ____.____

# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]

print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])
Upravit a spustit kód