Histogrammes
L'ensemble de données loan_data est chargé dans votre espace de travail. Vous avez déjà exploré des variables catégorielles avec la fonction CrossTable(). Vous souhaitez maintenant explorer des variables continues pour repérer d'éventuelles valeurs aberrantes ou des structures de données inattendues.
Pour ce faire, essayons la fonction hist() afin de comprendre la distribution du nombre de prêts pour différents clients.
Cette activité fait partie du cours
Modélisation du risque de crédit en R
Instructions de l’exercice
- Utilisez hist() pour créer un histogramme avec un seul argument :
loan_data$loan_amnt. Assignez le résultat à un nouvel objet nomméhist_1. - Utilisez
$breaksavec l'objethist_1pour obtenir plus d'information sur les coupures (breaks) de l'histogramme. Connaître l'emplacement des coupures est important, car si elles sont mal choisies, l'histogramme peut induire en erreur. - Modifiez le nombre de coupures dans
hist_1à 200 en précisant l'argumentbreaks. De plus, nommez l'axe des x"Loan amount"avec l'argumentxlabet donnez le titre"Histogram of the loan amount"avec l'argumentmain. Enregistrez le résultat danshist_2. Pourquoi les pics apparaissent-ils aux endroits où ils apparaissent ?
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Create histogram of loan_amnt: hist_1
# Print locations of the breaks in hist_1
# Change number of breaks and add labels: hist_2
hist_2 <- hist(loan_data$loan_amnt, breaks = ___, xlab = "___",
main = "___")