Leniwy podział na zbiór treningowy i testowy
Zmienne X zostały już przetworzone. Teraz trzeba dokończyć przygotowanie danych – przetworzyć zmienne y i podzielić dane na zbiór treningowy i testowy.
Zmienne X i y, utworzone w poprzednim ćwiczeniu, są dostępne w twoim środowisku.
To ćwiczenie jest częścią kursu
Programowanie równoległe z Dask w Pythonie
Instrukcje do ćwiczenia
- Zaimportuj funkcję
train_test_split()zdask_ml.model_selection. - Wyniki popularności w
ymieszczą się w zakresie 0–100 – podziel je przez 100, aby uzyskać zakres 0–1. - Podziel dane na zbiór treningowy i testowy za pomocą funkcji
train_test_split(), pamiętając o przetasowaniu danych i ustawieniu frakcji testowej na 20%.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Import the train_test_split function
from ____ import ____
# Rescale the target values
y = ____
# Split the data into train and test sets
X_train, X_test, y_train, y_test = ____
print(X_train)