Modeli eğitim verisine uydurma
Verilerini bir modeli uyarlamak için bir eğitim kümesine ve modelin öngörü gücünü değerlendirmek için ayrı bir test kümesine ayırma zamanı. Ancak bu bölmeyi yapmadan önce, house_prices veri kümesindeki satırların %100’ünü yeniden örnekleme yapmadan örnekleyip house_prices_shuffled değişkenine atıyoruz. Bu, satırları "karıştırma" etkisi yaratarak eğitim ve test kümelerinin rastgele seçilmesini sağlar.
Bu egzersiz, kursun bir parçasıdır
Tidyverse ile Verilerle Modelleme
Uygulamalı etkileşimli egzersiz
Bu egzersizi bu örnek kodu tamamlayarak deneyin.
# Set random number generator seed value for reproducibility
set.seed(76)
# Randomly reorder the rows
house_prices_shuffled <- house_prices %>%
sample_frac(size = 1, replace = FALSE)
# Train/test split
train <- house_prices_shuffled %>%
slice(___:___)
test <- house_prices_shuffled %>%
slice(___:___)