Compararea valorilor prezise
În exercițiul anterior, ai antrenat atât un model de regresie liniară, cât și un GLM (logistic) folosind datele crab, prezicând y în funcție de width. Cu alte cuvinte, ai vrut să estimezi probabilitatea ca o femelă să aibă un crab satelit în apropiere, în funcție de lățimea ei.
În acest exercițiu, vei analiza mai îndeaproape probabilitățile estimate (rezultatele) furnizate de cele două modele și vei încerca să determini dacă regresia liniară ar fi potrivită pentru această problemă.
Practica obișnuită este să testezi modelul pe date noi, nevăzute. Un astfel de set de date se numește eșantion de testare.
Eșantionul test a fost creat pentru tine și încărcat în spațiul de lucru. Reține că ai nevoie de valori de test pentru toate variabilele prezente în model — în acest caz, width.
Setul de date crab a fost preîncărcat în spațiul de lucru.
Acest exercițiu face parte din cursul
Modele Liniare Generalizate în Python
Instrucțiuni pentru exercițiu
- Folosind
print(), afișează setultest. - Folosind eșantionul
test, calculează probabilitățile estimate apelând.predict()pe modelul liniar antrenatmodel_LMși salvează rezultatul capred_lm. De asemenea, calculează probabilitățile estimate apelând.predict()pe modelul GLM (logistic) salvat camodel_GLMși salvează rezultatul capred_glm. - Folosind
DataFrame()dinpandas, combină predicțiile ambelor modele și salvează rezultatul capredictions. - Concatenează
testșipredictionsși salvează caall_data. Afișeazăall_datafolosindprint().
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# View test set
print(____)
# Compute estimated probabilities for linear model: pred_lm
____ = model_LM.____(____)
# Compute estimated probabilities for GLM model: pred_glm
____ = model_GLM.____(____)
# Create dataframe of predictions for linear and GLM model: predictions
____ = pd.DataFrame({'Pred_LM': ____, 'Pred_GLM': ____})
# Concatenate test sample and predictions and view the results
all_data = pd.concat([____, ____], axis = 1)
print(____)