Bắt đầu ngayBắt đầu miễn phí

Chi phí thực sự của phát hiện gian lận

Bạn đã xây dựng hai mô hình trên bộ huấn luyện gốc (model_orig) và bộ huấn luyện đã cân bằng lại (model_smote). Các lớp dự đoán cho các trường hợp trong tập test lần lượt được gọi là predicted_class_origpredicted_class_smote. Thay vì so sánh các mô hình phát hiện gian lận dựa trên độ chính xác, tốt hơn là bạn nên tính chi phí phát hiện của chúng.

Dưới đây là định nghĩa hàm cost_model(). Hãy xem qua để hiểu cách chi phí được tính.

cost_model <- function(predicted.classes, true.classes, amounts, fixedcost) {
  library(hmeasure)
  predicted.classes <- relabel(predicted.classes)
  true.classes <- relabel(true.classes)
  cost <- sum(true.classes * (1 - predicted.classes) * amounts + predicted.classes * fixedcost)
  return(cost)
}

Bài tập này là một phần của khóa học

Phát hiện gian lận với R

Xem khóa học

Hướng dẫn bài tập

  • Dùng cost_model() để tính chi phí thực sự khi triển khai model_orig trên tập kiểm tra, với fixedcost bằng 10.
  • Dùng cost_model() để tính chi phí thực sự khi triển khai model_smote trên tập kiểm tra, với fixedcost bằng 10.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Calculate the total cost of deploying the original model
cost_model(___, ___, ___, ___)

# Calculate the total cost of deploying the model using SMOTE
cost_model(___, ___, ___, ___)
Chỉnh sửa và Chạy Mã