Передбачення ймовірностей для рецензій на фільми
У цьому завданні ви побудуєте логістичну регресію, використовуючи набір даних movies. Мітки збережено в масиві y, а ознаки — у X.
Навчіть модель на тренувальних даних. Замість передбачення класів спрогнозуйте ймовірності того, що кожен елемент тестової вибірки належить до кожного з двох класів.
Функції логістичної регресії та розбиття на тренувальну/тестову вибірки вже імпортовано для вас.
Ця вправа є частиною курсу
Аналіз тональності в Python
Інструкції до вправи
- Розбийте дані на тренувальну й тестову вибірки.
- Навчіть модель логістичної регресії.
- Передбачте ймовірності для класу 0 і класу 1 на тестових даних. Клас 0 відповідає першому стовпцю в матриці передбачених ймовірностей, а клас 1 — другому.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)
# Train a logistic regression
log_reg = ____.____
# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]
print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])