Podział na zbiór treningowy i testowy
Aby przetestować swoje modele, musisz zbudować je i ocenić na dwóch różnych częściach danych – inaczej to jak ściąganie na egzaminie (skoro znasz już odpowiedzi).
Podział danych to nieodłączny etap procesu modelowania. Zaczniesz od podziału zbioru danych dotyczących cukrzycy i sprawdzenia proporcji tego podziału.
Dane diabetes z poprzedniego ćwiczenia są już wczytane do twojego środowiska pracy.
To ćwiczenie jest częścią kursu
Uczenie maszynowe z modelami drzewiastymi w R
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Create the split
diabetes_split <- ___(___, prop = ___)
# Print the data split
___