トレーニングデータへのモデル当てはめ
モデルを当てはめるための「トレーニング」データと、モデルの予測力を評価するための別の「テスト」データに分割しましょう。ただしその前に、house_prices の全行を置換なしでサンプリングして house_prices_shuffled に代入します。これにより行が「シャッフル」され、トレーニングセットとテストセットが「ランダム」に抽出されるようにします。
この演習はコースの一部です
tidyverse で学ぶモデリング
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Set random number generator seed value for reproducibility
set.seed(76)
# Randomly reorder the rows
house_prices_shuffled <- house_prices %>%
sample_frac(size = 1, replace = FALSE)
# Train/test split
train <- house_prices_shuffled %>%
slice(___:___)
test <- house_prices_shuffled %>%
slice(___:___)