Huấn luyện glmnet với trainControl tùy chỉnh
Bây giờ bạn đã có một đối tượng trainControl tùy chỉnh, hãy huấn luyện một mô hình glmnet trên bộ dữ liệu "don't overfit". Nhớ lại từ video rằng glmnet là phần mở rộng của mô hình hồi quy tuyến tính tổng quát (hay glm) với các ràng buộc lên độ lớn của hệ số để tránh overfitting. Cách tiếp cận này thường được gọi là hồi quy "có phạt" (penalized) và rất hữu ích cho các bộ dữ liệu có nhiều biến dự đoán nhưng ít quan sát.
glmnet có thể khớp hai loại mô hình penalized khác nhau, được điều khiển bởi tham số alpha:
- Hồi quy Ridge (tức
alpha = 0) - Hồi quy Lasso (tức
alpha = 1)
Giờ bạn sẽ huấn luyện một mô hình glmnet trên bộ dữ liệu "don't overfit" dùng các thiết lập mặc định do gói caret cung cấp.
Bài tập này là một phần của khóa học
Machine Learning với caret trong R
Hướng dẫn bài tập
- Huấn luyện một mô hình
glmnettên làmodeltrên dữ liệuoverfit. DùngtrainControltùy chỉnh từ bài trước (myControl). Biếnylà biến phản hồi và tất cả biến còn lại là biến giải thích. - In mô hình ra console.
- Dùng hàm
max()để tìm giá trị lớn nhất của chỉ số ROC nằm đâu đó trongmodel[["results"]].
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Fit glmnet model: model
model <- train(
___,
___,
method = "glmnet",
trControl = ___
)
# Print model to console
# Print maximum ROC statistic