훈련 데이터에 모델 적합하기
이제 데이터를 모델을 학습할 훈련 세트와, 모델의 예측 성능을 평가할 별도의 테스트 세트로 나눌 차례예요. 그 전에 먼저, house_prices의 모든 행 100%를 치환 없이 표본추출하여 house_prices_shuffled에 저장해 둡니다. 이렇게 하면 행이 "섞이는" 효과가 있어, 훈련 세트와 테스트 세트를 무작위로 추출할 수 있어요.
이 연습은 강의의 일부입니다
Tidyverse로 하는 데이터 모델링
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Set random number generator seed value for reproducibility
set.seed(76)
# Randomly reorder the rows
house_prices_shuffled <- house_prices %>%
sample_frac(size = 1, replace = FALSE)
# Train/test split
train <- house_prices_shuffled %>%
slice(___:___)
test <- house_prices_shuffled %>%
slice(___:___)