开始使用免费开始使用

预测电影评论的概率

本题将使用 movies 数据集来构建逻辑回归模型。标签存于数组 y,特征存于 X

请在训练数据上训练模型。与直接预测类别不同,这里要预测测试集中每个样本属于两个类别中各自的概率。

逻辑回归与训练/测试集划分所需的函数已为您导入。

本练习是课程的一部分

Python 中的情感分析

查看课程

练习说明

  • 将数据划分为训练集和测试集。
  • 训练一个逻辑回归模型。
  • 对测试数据分别预测其属于类别 0 和类别 1 的概率。预测概率矩阵中,类别 0 位于第一列,类别 1 位于第二列。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)

# Train a logistic regression
log_reg = ____.____

# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]

print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])
编辑并运行代码