Zacznij terazZacznij za darmo

Wypróbuj podział 80/20

Skoro zbiór danych jest już losowo posortowany, możesz podzielić go na dwie części: pierwsze 80% wierszy trafi do zbioru treningowego, a ostatnie 20% – do zbioru testowego. Wystarczy wyznaczyć punkt podziału mniej więcej w 80% długości zbioru danych:

split <- round(nrow(mydata) * 0.80)

Następnie użyj tego punktu, aby wyodrębnić pierwsze 80% danych jako zbiór treningowy:

mydata[1:split, ]

Ten sam punkt posłuży do wyznaczenia zbioru testowego:

mydata[(split + 1):nrow(mydata), ]

To ćwiczenie jest częścią kursu

Uczenie maszynowe z caret w R

Zobacz kurs

Instrukcje do ćwiczenia

  • Wyznacz indeks wiersza, który wyznaczy punkt podziału mniej więcej w 80% zbioru danych diamonds. Nazwij ten indeks split.
  • Utwórz zbiór treningowy o nazwie train, korzystając z tego indeksu.
  • Utwórz zbiór testowy o nazwie test, korzystając z tego indeksu.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Determine row to split on: split


# Create train


# Create test
Edytuj i uruchom kod