Împărțirea în set de antrenament/set de testare
Pentru a testa modelele, trebuie să le construiești și să le evaluezi pe două părți diferite ale datelor – altfel, e ca și cum ai copia la un examen (pentru că știi deja răspunsurile).
Împărțirea datelor este o etapă esențială a procesului de modelare. Vei explora acest lucru împărțind setul de date despre diabet și verificând proporțiile rezultate.
Setul de date diabetes din exercițiul anterior este deja încărcat în spațiul tău de lucru.
Acest exercițiu face parte din cursul
Machine Learning cu modele bazate pe arbori în R
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Create the split
diabetes_split <- ___(___, prop = ___)
# Print the data split
___