映画レビューの確率を予測する
この問題では、movies データセットを使ってロジスティック回帰を構築します。ラベルは配列 y、特徴量は X に入っています。
学習用データでモデルを学習させてください。クラスを直接予測するのではなく、テストセットの各インスタンスが2つのクラスのどちらに属するかの確率を予測します。
ロジスティック回帰と train/test 分割用の関数は、すでにインポート済みです。
この演習はコースの一部です
Pythonで学ぶSentiment Analysis
演習の手順
- データを学習用とテスト用に分割します。
- ロジスティック回帰モデルを学習させます。
- テストデータに対して、クラス0とクラス1の確率を予測します。予測確率では、クラス0が1列目、クラス1が2列目にあります。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)
# Train a logistic regression
log_reg = ____.____
# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]
print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])