시작하기무료로 시작하기

훈련 데이터에 모델 적합하기

이제 데이터를 모델을 학습할 훈련 세트와, 모델의 예측 성능을 평가할 별도의 테스트 세트로 나눌 차례예요. 그 전에 먼저, house_prices의 모든 행 100%를 치환 없이 표본추출하여 house_prices_shuffled에 저장해 둡니다. 이렇게 하면 행이 "섞이는" 효과가 있어, 훈련 세트와 테스트 세트를 무작위로 추출할 수 있어요.

이 연습은 강의의 일부입니다

Tidyverse로 하는 데이터 모델링

강의 보기

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Set random number generator seed value for reproducibility
set.seed(76)

# Randomly reorder the rows
house_prices_shuffled <- house_prices %>% 
  sample_frac(size = 1, replace = FALSE)

# Train/test split
train <- house_prices_shuffled %>%
  slice(___:___)
test <- house_prices_shuffled %>%
  slice(___:___)
코드 편집 및 실행