Scalarea datelor – standardizarea coloanelor
Știm că coloanele Ash, Alcalinity of ash și Magnesium din setul de date wine au scale diferite, așa că hai să le standardizăm pentru a le putea folosi într-un model liniar.
Acest exercițiu face parte din cursul
Preprocesare pentru Machine Learning în Python
Instrucțiuni pentru exercițiu
- Importă clasa
StandardScaler. - Instanțiază un
StandardScaler()și stochează-l în variabilascaler. - Creează un subset al DataFrame-ului
winecare să conțină coloaneleAsh,Alcalinity of ashșiMagnesium, și atribuie-l variabileiwine_subset. - Aplică fit și transform cu scalerul standard pe
wine_subset.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Import StandardScaler
from sklearn.preprocessing import ____
# Create the scaler
scaler = ____
# Subset the DataFrame you want to scale
____ = wine[[____]]
# Apply the scaler to wine_subset
wine_subset_scaled = scaler.____(____)