Kom igångKom igång gratis

Klassificeringsrapport för betalningsinställelse

Nu är det dags att titta närmare på utvärderingen av modellen. Här hjälper tröskelvärdet för sannolikheten för betalningsinställelse dig att analysera modellens prestanda via klassificeringsrapportering.

Genom att skapa en dataframe med sannolikheterna blir de enklare att arbeta med, eftersom du kan utnyttja hela kraften i pandas. Tillämpa tröskelvärdet på datan och kontrollera värdeantalen för båda klasserna i loan_status för att se hur många förutsägelser av varje slag som genereras. Det ger dig bättre förståelse för resultaten från klassificeringsrapporten.

Datamängden cr_loan_prep, den tränade logistiska regressionen clf_logistic, de sanna värdena för lånestatus y_test och de förutsagda sannolikheterna preds är inlästa i arbetsytan.

Den här övningen är en del av kursen

Kreditriskmodellering i Python

Visa kurs

Övningsinstruktioner

  • Skapa en dataframe med enbart sannolikheterna för betalningsinställelse från preds och kalla den preds_df.
  • Tilldela om värdena för loan_status baserat på ett tröskelvärde på 0.50 för sannolikhet för betalningsinställelse i preds_df.
  • Skriv ut värdeantalen för antalet rader per loan_status.
  • Skriv ut klassificeringsrapporten med hjälp av y_test och preds_df.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Create a dataframe for the probabilities of default
____ = pd.____(____[:,1], columns = ['prob_default'])

# Reassign loan status based on the threshold
____[____] = ____[____].apply(lambda x: 1 if x > ____ else 0)

# Print the row counts for each loan status
print(____[____].____())

# Print the classification report
target_names = ['Non-Default', 'Default']
print(____(____, ____['loan_status'], target_names=target_names))
Redigera och kör kod