Масштабирование данных — стандартизация столбцов
Столбцы Ash, Alcalinity of ash и Magnesium в наборе данных wine имеют разные шкалы. Стандартизируем их так, чтобы данные можно было использовать в линейной модели.
Это упражнение является частью курса
Предобработка данных для машинного обучения на Python
Инструкции к упражнению
- Импортируйте класс
StandardScaler. - Создайте экземпляр
StandardScaler()и сохраните его в переменнуюscaler. - Создайте подмножество DataFrame
wine, включающее столбцыAsh,Alcalinity of ashиMagnesium, и присвойте его переменнойwine_subset. - Обучите стандартный масштабировщик на данных
wine_subsetи преобразуйте их.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Import StandardScaler
from sklearn.preprocessing import ____
# Create the scaler
scaler = ____
# Subset the DataFrame you want to scale
____ = wine[[____]]
# Apply the scaler to wine_subset
wine_subset_scaled = scaler.____(____)