Specifikace a odhadnutí modelu
Už znáš příkaz glm() pro spuštění logistické regrese. glm() je zkratka pro generalizovaný lineární model a nabízí celou rodinu regresních modelů.
Pro tento úkol použij cvičný dataset. Data defaultData, která budeš potřebovat, jsou dostupná v tvém prostředí a připravená k modelování.
Toto cvičení je součástí kurzu
Machine Learning for Marketing Analytics in R
Pokyny k cvičení
- Pomocí funkce
glm()sestav model pravděpodobnosti, že zákazník nesplatí svůj závazek – použij logistickou regresi. Zahrň všechny vysvětlující proměnné datasetu a zadej data, která se mají použít. - Nezapomeň specifikovat argument
family. - Extrahuj koeficienty z modelu, převeď je na odds ratios a zaokrouhli.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Build logistic regression model
logitModelFull <- ___(PaymentDefault ~ limitBal + sex + education + marriage +
age + pay1 + pay2 + pay3 + pay4 + pay5 + pay6 + billAmt1 +
billAmt2 + billAmt3 + billAmt4 + billAmt5 + billAmt6 + payAmt1 +
payAmt2 + payAmt3 + payAmt4 + payAmt5 + payAmt6,
family = ___, data = ___)
# Take a look at the model
___(logitModelFull)
# Take a look at the odds ratios
coefsexp <- ___(logitModelFull) %>% ___ %>% round(2)
coefsexp