Skalowanie danych – standaryzacja kolumn
Skoro wiemy, że kolumny Ash, Alcalinity of ash i Magnesium w zbiorze danych wine mają różne skale, wystandaryzujmy je w sposób umożliwiający wykorzystanie w modelu liniowym.
To ćwiczenie jest częścią kursu
Preprocessing w uczeniu maszynowym w Pythonie
Instrukcje do ćwiczenia
- Zaimportuj klasę
StandardScaler. - Utwórz instancję
StandardScaler()i przypisz ją do zmiennejscaler. - Utwórz podzbiór ramki danych
winezawierający kolumnyAsh,Alcalinity of ashiMagnesium, a następnie przypisz go do zmiennejwine_subset. - Dopasuj standardowy skaler do
wine_subseti przekształć te dane.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Import StandardScaler
from sklearn.preprocessing import ____
# Create the scaler
scaler = ____
# Subset the DataFrame you want to scale
____ = wine[[____]]
# Apply the scaler to wine_subset
wine_subset_scaled = scaler.____(____)