Hög bias eller hög varians?
I den här övningen ska du diagnostisera om regressionsträdet dt som du tränade i föregående övning lider av ett bias- eller variansproblem.
RMSE för träningsdata (RMSE_train) och RMSE för korsvalidering (RMSE_CV) som uppnåddes av dt finns tillgängliga i din arbetsyta. Dessutom har vi laddat in en variabel som heter baseline_RMSE, vilken motsvarar det rotmedelkvadratfel som uppnåddes av regressionsträdet tränat enbart med särsdraget disp (det är det RMSE som uppnåddes av regressionsträdet i kapitel 1, lektion 3). Här fungerar baseline_RMSE som ett referensvärde – en modell som ligger över detta värde anses underanpassa, medan en modell som ligger under anses vara tillräckligt bra.
Lider dt av ett högt bias- eller ett högt variansproblem?
Den här övningen är en del av kursen
Maskininlärning med trädbaserade modeller i Python
Interaktiv övning med praktiskt arbete
Gör teori till handling med en av våra interaktiva övningar
Starta övningen