Bắt đầu ngayBắt đầu miễn phí

Khớp mô hình với dữ liệu huấn luyện

Đến lúc bạn chia dữ liệu thành một tập training để khớp mô hình và một tập test riêng để đánh giá khả năng dự đoán của mô hình. Tuy nhiên, trước khi tách, ta sẽ lấy mẫu 100% số dòng của house_prices không hoàn lại và gán vào house_prices_shuffled. Cách này sẽ “xáo trộn” các dòng, giúp đảm bảo tập training và test được lấy mẫu ngẫu nhiên.

Bài tập này là một phần của khóa học

Mô hình hóa với dữ liệu trong Tidyverse

Xem khóa học

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Set random number generator seed value for reproducibility
set.seed(76)

# Randomly reorder the rows
house_prices_shuffled <- house_prices %>% 
  sample_frac(size = 1, replace = FALSE)

# Train/test split
train <- house_prices_shuffled %>%
  slice(___:___)
test <- house_prices_shuffled %>%
  slice(___:___)
Chỉnh sửa và Chạy Mã