CommencezCommencez gratuitement

Histogrammes

L'ensemble de données loan_data est chargé dans votre espace de travail. Vous avez déjà exploré des variables catégorielles avec la fonction CrossTable(). Vous souhaitez maintenant explorer des variables continues pour repérer d'éventuelles valeurs aberrantes ou des structures de données inattendues.

Pour ce faire, essayons la fonction hist() afin de comprendre la distribution du nombre de prêts pour différents clients.

Cette activité fait partie du cours

Modélisation du risque de crédit en R

Voir le cours

Instructions de l’exercice

  • Utilisez hist() pour créer un histogramme avec un seul argument : loan_data$loan_amnt. Assignez le résultat à un nouvel objet nommé hist_1.
  • Utilisez $breaks avec l'objet hist_1 pour obtenir plus d'information sur les coupures (breaks) de l'histogramme. Connaître l'emplacement des coupures est important, car si elles sont mal choisies, l'histogramme peut induire en erreur.
  • Modifiez le nombre de coupures dans hist_1 à 200 en précisant l'argument breaks. De plus, nommez l'axe des x "Loan amount" avec l'argument xlab et donnez le titre "Histogram of the loan amount" avec l'argument main. Enregistrez le résultat dans hist_2. Pourquoi les pics apparaissent-ils aux endroits où ils apparaissent ?

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Create histogram of loan_amnt: hist_1


# Print locations of the breaks in hist_1


# Change number of breaks and add labels: hist_2
hist_2 <- hist(loan_data$loan_amnt, breaks = ___, xlab = "___", 
               main = "___")
Modifier et exécuter le code