Předpovídání pravděpodobnosti selhání
Ve videu jsi viděl/a předpovězenou pravděpodobnost selhání pro jeden případ z testovací sady. Naštěstí můžeš pomocí funkce predict() předpovědět pravděpodobnost pro všechny případy z testovací sady najednou.
Jakmile získáš všechny předpovědi pro prvky testovací sady, je užitečné udělat si první představu o tom, jak dobře model rozlišuje – stačí se podívat na rozsah předpovězených pravděpodobností. Malý rozsah znamená, že předpovědi pro jednotlivé případy z testovací sady se od sebe příliš neliší, a model tedy nemusí být v rozlišování dobrých a špatných zákazníků příliš úspěšný. Při nízkém procentu selhání si všimneš, že model obecně předpovídá velmi nízké pravděpodobnosti selhání. Je čas podívat se na první model.
V prostředí je načten objekt log_model_small.
Toto cvičení je součástí kurzu
Modelování kreditního rizika v R
Pokyny k cvičení
- Kód pro předpověď
test_casez videa je zkopírován do tvého prostředí. Uprav ho tak, aby se funkcepredict()aplikovala na všechny případy vtest_set. Výsledky můžeš uložit do objektupredictions_all_small. - Získej první představu o tom, jak dobře model dokáže rozlišovat, pomocí funkce
range().
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Make PD-predictions for all the test set elements using the "log_model_small" logistic regression model
predictions_all_small <- predict(log_model_small, newdata = test_case, type = "response")
# Look at the range of the object "predictions_all_small"