Zacznij terazZacznij za darmo

Podział na zbiór treningowy i testowy

Aby przetestować swoje modele, musisz zbudować je i ocenić na dwóch różnych częściach danych – inaczej to jak ściąganie na egzaminie (skoro znasz już odpowiedzi).

Podział danych to nieodłączny etap procesu modelowania. Zaczniesz od podziału zbioru danych dotyczących cukrzycy i sprawdzenia proporcji tego podziału.

Dane diabetes z poprzedniego ćwiczenia są już wczytane do twojego środowiska pracy.

To ćwiczenie jest częścią kursu

Uczenie maszynowe z modelami drzewiastymi w R

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Create the split
diabetes_split <- ___(___, prop = ___)

# Print the data split
___
Edytuj i uruchom kod