Chi phí thực sự của phát hiện gian lận
Bạn đã xây dựng hai mô hình trên bộ huấn luyện gốc (model_orig) và bộ huấn luyện đã cân bằng lại (model_smote). Các lớp dự đoán cho các trường hợp trong tập test lần lượt được gọi là predicted_class_orig và predicted_class_smote. Thay vì so sánh các mô hình phát hiện gian lận dựa trên độ chính xác, tốt hơn là bạn nên tính chi phí phát hiện của chúng.
Dưới đây là định nghĩa hàm cost_model(). Hãy xem qua để hiểu cách chi phí được tính.
cost_model <- function(predicted.classes, true.classes, amounts, fixedcost) {
library(hmeasure)
predicted.classes <- relabel(predicted.classes)
true.classes <- relabel(true.classes)
cost <- sum(true.classes * (1 - predicted.classes) * amounts + predicted.classes * fixedcost)
return(cost)
}
Bài tập này là một phần của khóa học
Phát hiện gian lận với R
Hướng dẫn bài tập
- Dùng
cost_model()để tính chi phí thực sự khi triển khaimodel_origtrên tập kiểm tra, vớifixedcostbằng 10. - Dùng
cost_model()để tính chi phí thực sự khi triển khaimodel_smotetrên tập kiểm tra, vớifixedcostbằng 10.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Calculate the total cost of deploying the original model
cost_model(___, ___, ___, ___)
# Calculate the total cost of deploying the model using SMOTE
cost_model(___, ___, ___, ___)