始める無料で始める

映画レビューの確率を予測する

この問題では、movies データセットを使ってロジスティック回帰を構築します。ラベルは配列 y、特徴量は X に入っています。

学習用データでモデルを学習させてください。クラスを直接予測するのではなく、テストセットの各インスタンスが2つのクラスのどちらに属するかの確率を予測します。

ロジスティック回帰と train/test 分割用の関数は、すでにインポート済みです。

この演習はコースの一部です

Pythonで学ぶSentiment Analysis

コースを見る

演習の手順

  • データを学習用とテスト用に分割します。
  • ロジスティック回帰モデルを学習させます。
  • テストデータに対して、クラス0とクラス1の確率を予測します。予測確率では、クラス0が1列目、クラス1が2列目にあります。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)

# Train a logistic regression
log_reg = ____.____

# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]

print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])
コードを編集して実行