始める無料で始める

トレーニングデータへのモデル当てはめ

モデルを当てはめるための「トレーニング」データと、モデルの予測力を評価するための別の「テスト」データに分割しましょう。ただしその前に、house_prices の全行を置換なしでサンプリングして house_prices_shuffled に代入します。これにより行が「シャッフル」され、トレーニングセットとテストセットが「ランダム」に抽出されるようにします。

この演習はコースの一部です

tidyverse で学ぶモデリング

コースを見る

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Set random number generator seed value for reproducibility
set.seed(76)

# Randomly reorder the rows
house_prices_shuffled <- house_prices %>% 
  sample_frac(size = 1, replace = FALSE)

# Train/test split
train <- house_prices_shuffled %>%
  slice(___:___)
test <- house_prices_shuffled %>%
  slice(___:___)
コードを編集して実行