Histogram
Datamängden loan_data är inläst i din arbetsmiljö. Du har tidigare utforskat kategoriska variabler med funktionen CrossTable(). Nu vill du utforska kontinuerliga variabler för att identifiera potentiella avvikande värden eller oväntade datastrukturer.
Låt oss experimentera med funktionen hist() för att förstå fördelningen av antalet lån för olika kunder.
Den här övningen är en del av kursen
Kreditriskmodellering i R
Övningsinstruktioner
- Använd hist() för att skapa ett histogram med bara ett argument:
loan_data$loan_amnt. Tilldela resultatet till ett nytt objekt som heterhist_1. - Använd
$breakstillsammans med objektethist_1för att få mer information om histogrammets brytpunkter. Det är viktigt att känna till var brytpunkterna befinner sig, eftersom ett histogram kan bli missvisande om de är dåligt valda. - Ändra antalet brytpunkter i
hist_1till 200 genom att ange argumentetbreaks. Ge dessutom x-axeln etiketten"Loan amount"med argumentetxlaboch titeln"Histogram of the loan amount"med argumentetmain. Spara resultatet ihist_2. Varför uppstår topparna där de uppstår?
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create histogram of loan_amnt: hist_1
# Print locations of the breaks in hist_1
# Change number of breaks and add labels: hist_2
hist_2 <- hist(loan_data$loan_amnt, breaks = ___, xlab = "___",
main = "___")