預測電影評論的機率
在這題中,你將使用 movies 資料集建立一個邏輯斯迴歸模型。標籤存放在陣列 y,特徵存放在 X。
請在訓練資料上訓練模型。這次不要預測類別,而是預測測試集中每個樣本分屬兩個類別的機率。
已為你匯入邏輯斯迴歸與訓練/測試切分的函式。
本練習屬於課程
Python 情感分析
練習說明
- 將資料切分為訓練集與測試集。
- 訓練一個邏輯斯迴歸模型。
- 為測試資料預測類別 0 與類別 1 的機率。類別 0 的機率位於預測機率的第 1 欄,類別 1 的機率位於第 2 欄。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)
# Train a logistic regression
log_reg = ____.____
# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]
print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])