Zacznij terazZacznij za darmo

Tworzenie planu walidacji krzyżowej

Istnieje kilka sposobów implementacji planu n-krotnej walidacji krzyżowej. W tym ćwiczeniu stworzysz taki plan przy użyciu funkcji vtreat::kWayCrossValidation() i przeanalizujesz jego strukturę.

Funkcja kWayCrossValidation() tworzy plan walidacji krzyżowej za pomocą następującego wywołania:

splitPlan <- kWayCrossValidation(nRows, nSplits, dframe, y)

gdzie nRows to liczba wierszy danych do podziału, a nSplits to żądana liczba podziałów (foldów) walidacji krzyżowej.

Ściśle rzecz biorąc, argumenty dframe i y nie są wykorzystywane przez kWayCrossValidation – są obecne wyłącznie ze względu na zgodność z innymi funkcjami partycjonowania danych z pakietu vtreat. Możesz ustawić oba na NULL.

Wynikowy obiekt splitPlan to lista nSplits elementów; każdy element zawiera dwa wektory:

  • train: indeksy wierszy dframe, które trafią do zbioru treningowego
  • app: indeksy wierszy dframe, które trafią do zbioru testowego (aplikacyjnego)

W tym ćwiczeniu stworzysz plan 3-krotnej walidacji krzyżowej dla zbioru danych mpg.

To ćwiczenie jest częścią kursu

Nadzorowane uczenie maszynowe w R: regresja

Zobacz kurs

Instrukcje do ćwiczenia

  • Załaduj pakiet vtreat.
  • Pobierz liczbę wierszy w zbiorze mpg i przypisz ją do zmiennej nRows.
  • Wywołaj funkcję kWayCrossValidation, aby utworzyć plan 3-krotnej walidacji krzyżowej, i przypisz wynik do zmiennej splitPlan.
    • Dwa ostatnie argumenty funkcji możesz ustawić na NULL.
  • Wywołaj funkcję str(), aby zbadać strukturę obiektu splitPlan.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Load the package vtreat
___

# mpg is available
summary(mpg)

# Get the number of rows in mpg
nRows <- ___

# Implement the 3-fold cross-fold plan with vtreat
splitPlan <- ___

# Examine the split plan
___
Edytuj i uruchom kod