映画レビューのロジスティック回帰
この動画では、ロジスティック回帰が、肯定/否定といった分類タスクをモデル化する一般的な方法であることを学びました。
この演習では、movies レビューのデータセットを使います。label 列には感情が格納されており、レビューがポジティブなら 1、ネガティブなら 0 です。テキストレビューは BOW を用いて数値列に変換済みです。
あなたのタスクは、movies データセットでロジスティック回帰モデルを構築し、その正解率を計算することです。
この演習はコースの一部です
Pythonで学ぶSentiment Analysis
演習の手順
- ロジスティック回帰の関数をインポートします。
- ラベル
yと特徴量Xに対して、ロジスティック回帰モデルを作成して学習させます。 - 既定の
.score()メソッドを使って、ロジスティック回帰モデルの正解率を計算します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Import the logistic regression
from ____.____ import ____
# Define the vector of targets and matrix of features
y = movies.label
X = movies.drop('label', axis=1)
# Build a logistic regression model and calculate the accuracy
log_reg = ____.____(X, y)
print('Accuracy of logistic regression: ', log_reg.____(X, y))