Масштабування даних — стандартизація стовпців
Оскільки відомо, що стовпці Ash, Alcalinity of ash і Magnesium у наборі даних wine мають різні шкали, стандартизуйте їх так, щоб їх можна було використовувати в лінійній моделі.
Ця вправа є частиною курсу
Передобробка для машинного навчання в Python
Інструкції до вправи
- Імпортуйте клас
StandardScaler. - Створіть екземпляр
StandardScaler()і збережіть його в зміннійscaler. - Створіть підмножину датафрейму
wine, що містить стовпціAsh,Alcalinity of ashіMagnesium, та присвойте її зміннійwine_subset. - Навчіть стандартний скейлер і перетворіть ним
wine_subset.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Import StandardScaler
from sklearn.preprocessing import ____
# Create the scaler
scaler = ____
# Subset the DataFrame you want to scale
____ = wine[[____]]
# Apply the scaler to wine_subset
wine_subset_scaled = scaler.____(____)