НачатьНачать бесплатно

Масштабирование данных — стандартизация столбцов

Столбцы Ash, Alcalinity of ash и Magnesium в наборе данных wine имеют разные шкалы. Стандартизируем их так, чтобы данные можно было использовать в линейной модели.

Это упражнение является частью курса

Предобработка данных для машинного обучения на Python

Посмотреть курс

Инструкции к упражнению

  • Импортируйте класс StandardScaler.
  • Создайте экземпляр StandardScaler() и сохраните его в переменную scaler.
  • Создайте подмножество DataFrame wine, включающее столбцы Ash, Alcalinity of ash и Magnesium, и присвойте его переменной wine_subset.
  • Обучите стандартный масштабировщик на данных wine_subset и преобразуйте их.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Import StandardScaler
from sklearn.preprocessing import ____

# Create the scaler
scaler = ____

# Subset the DataFrame you want to scale 
____ = wine[[____]]

# Apply the scaler to wine_subset
wine_subset_scaled = scaler.____(____)
Редактировать и запускать код