Kom igångKom igång gratis

Histogram

Datamängden loan_data är inläst i din arbetsmiljö. Du har tidigare utforskat kategoriska variabler med funktionen CrossTable(). Nu vill du utforska kontinuerliga variabler för att identifiera potentiella avvikande värden eller oväntade datastrukturer.

Låt oss experimentera med funktionen hist() för att förstå fördelningen av antalet lån för olika kunder.

Den här övningen är en del av kursen

Kreditriskmodellering i R

Visa kurs

Övningsinstruktioner

  • Använd hist() för att skapa ett histogram med bara ett argument: loan_data$loan_amnt. Tilldela resultatet till ett nytt objekt som heter hist_1.
  • Använd $breaks tillsammans med objektet hist_1 för att få mer information om histogrammets brytpunkter. Det är viktigt att känna till var brytpunkterna befinner sig, eftersom ett histogram kan bli missvisande om de är dåligt valda.
  • Ändra antalet brytpunkter i hist_1 till 200 genom att ange argumentet breaks. Ge dessutom x-axeln etiketten "Loan amount" med argumentet xlab och titeln "Histogram of the loan amount" med argumentet main. Spara resultatet i hist_2. Varför uppstår topparna där de uppstår?

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Create histogram of loan_amnt: hist_1


# Print locations of the breaks in hist_1


# Change number of breaks and add labels: hist_2
hist_2 <- hist(loan_data$loan_amnt, breaks = ___, xlab = "___", 
               main = "___")
Redigera och kör kod