O pădure de arbori de decizie
În acest exercițiu, vei exersa utilizarea arborelui de decizie cu bootstrap, cunoscut și sub numele de Random Forest. La fel ca în exercițiul anterior, vei compara acuratețea sa cu cea a unui model ale cărui hiperparametri au fost ajustați prin validare încrucișată.
De data aceasta, vei ajusta un hiperparametru suplimentar, max_features, care îi permite modelului să decidă câte caracteristici să utilizeze. Dacă nu este setat explicit, valoarea implicită este auto. Un lucru important de reținut pentru un interviu este că arborii de decizie iau în considerare toate caracteristicile în mod implicit, în timp ce Random Forest consideră, de obicei, rădăcina pătrată din numărul total de caracteristici.
Matricea de caracteristici X, eticheta țintă y și train_test_split din sklearn.model_selection au fost deja importate pentru tine.
Acest exercițiu face parte din cursul
Exersează întrebări de interviu pentru Machine Learning în Python
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Import modules
from sklearn.ensemble import ____
from sklearn.metrics import accuracy_score
# Train/test split
X_train, X_test, y_train, y_test = train_test_split(____, ____, test_size=0.30, random_state=123)
# Instantiate, Fit, Predict
loans_rf = ____()
loans_rf.____(____, ____)
y_pred = loans_rf.____(____)
# Evaluation metric
print("Random Forest Accuracy: {}".format(____(____,____)))