計算混淆矩陣
「混淆矩陣」(有時也稱為「混淆表」)是評估類別型應變數模型(例如邏輯斯迴歸)效能的基礎。它包含每一種「實際回應-預測回應」組合的筆數。在本例中,可能的回應有 2 種(流失或未流失),因此整體有 4 種結果。
- 客戶確實流失,模型也預測流失。
- 客戶確實流失,但模型未預測流失。
- 客戶未流失,但模型預測流失。
- 客戶未流失,模型也預測未流失。
churn 與 mdl_churn_vs_relationship 已可使用。
本練習屬於課程
R 迴歸入門
練習說明
- 從資料集的
has_churned欄位取得實際回應,指派給actual_response。 - 從模型取得「最可能」的預測回應,指派給
predicted_response。 - 以實際與預測回應向量建立次數表,指派給
outcomes。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Get the actual responses from the dataset
actual_response <- ___
# Get the "most likely" responses from the model
predicted_response <- ___
# Create a table of counts
outcomes <- ___
# See the result
outcomes