Histogramy
Datová sada loan_data je načtena v tvém pracovním prostředí. Kategorické proměnné jsi už prozkoumal/a pomocí funkce CrossTable(). Teď se zaměříme na spojité proměnné, abychom odhalili případné odlehlé hodnoty nebo neočekávané struktury v datech.
Vyzkoušejme funkci hist() a prozkoumejme rozložení počtu půjček pro různé zákazníky.
Toto cvičení je součástí kurzu
Modelování kreditního rizika v R
Pokyny k cvičení
- Pomocí hist() vytvoř histogram s jediným argumentem:
loan_data$loan_amnt. Výsledek ulož do nového objektu s názvemhist_1. - Pomocí
$breaksa objektuhist_1zjisti více informací o hranicích histogramu. Poloha hranic je důležitá – pokud jsou zvoleny nevhodně, histogram může být zavádějící. - Změň počet hranic v
hist_1na 200 zadáním argumentubreaks. Pojmenuj také osu x hodnotou"Loan amount"pomocí argumentuxlaba nastav název grafu na"Histogram of the loan amount"pomocí argumentumain. Výsledek ulož dohist_2. Proč se vrcholy nacházejí právě tam, kde jsou?
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Create histogram of loan_amnt: hist_1
# Print locations of the breaks in hist_1
# Change number of breaks and add labels: hist_2
hist_2 <- hist(loan_data$loan_amnt, breaks = ___, xlab = "___",
main = "___")