始める無料で始める

ブートストラップ集約(バギング)

前のレッスンでは、特徴量エンジニアリングを行ったデータにロジスティック回帰を適用し、分類モデルに少し触れました。Machine Learning の面接では、弱学習器を組み合わせて精度を高める強力な学習器を作るアンサンブルモデルについて知っておくと役に立つことがあります。

この演習では、置換ありのサンプリング手法を用いてランダム性を保ち、過学習を抑えるバギング分類器から始めます。動画の演習で見た sklearn.ensemble モジュールの関数を使用します。

必要なパッケージはすべてインポート済みです: pandaspdsklearn.model_selection から train_test_splitsklearn.metrics から accuracy_scoresklearn.linear_model から LogisticRegression、そして sklearn.ensemble から BaggingClassifierAdaBoostClassifier

loan_data の DataFrame はすでに X_trainX_testy_trainy_test に分割されています。

この演習はコースの一部です

Pythonで学ぶMachine Learning面接対策

コースを見る

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Instantiate bootstrap aggregation model
bagged_model = ____(____=____, random_state=123)
コードを編集して実行