始める無料で始める

前処理と分割

ターゲット変数 Attrition に関連する 30 個の特徴量を持ち、欠損値を含む 1470 件のインスタンスからなる完全な attrition データセットを使います。ミッションは、ターゲットを予測するエンドツーエンドのモデルを構築することです。データセットはすでに読み込まれています。

まずは、データの前処理と分割から始めます。

この演習はコースの一部です

Rで学ぶ特徴量エンジニアリング

コースを見る

演習の手順

  • まず、すべての character 型の値を factor に変換します。
  • 学習用とテスト用にデータを分割します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Transform all character values to factors
attrition <- 
  attrition %>%
  mutate(___(where(___), as_factor))
  
# Create train and test splits
set.seed(123)
split <- initial_split(attrition, strata = Attrition)
test <- ___(split)
train <- ___(___)

glimpse(train)
コードを編集して実行