Предсказание вероятностей для отзывов о фильмах
В этом упражнении вы построите логистическую регрессию на основе набора данных movies. Метки хранятся в массиве y, а признаки — в X.
Обучите модель на обучающих данных. Вместо предсказания классов предскажите вероятности принадлежности каждого объекта из тестовой выборки к каждому из двух классов.
Функции логистической регрессии и разделения на обучающую и тестовую выборки уже импортированы.
Это упражнение является частью курса
Анализ тональности текста на Python
Инструкции к упражнению
- Разделите данные на обучающую и тестовую выборки.
- Обучите модель логистической регрессии.
- Предскажите вероятности для класса 0 и класса 1 на тестовых данных. Класс 0 находится в первом столбце предсказанных вероятностей, класс 1 — во втором.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)
# Train a logistic regression
log_reg = ____.____
# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]
print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])