数据缩放——标准化列
我们已经知道 wine 数据集中的 Ash、Alcalinity of ash 和 Magnesium 列处在不同的量纲上。让我们把它们标准化,以便能用于线性模型。
本练习是课程的一部分
Python 中的机器学习预处理
练习说明
- 导入
StandardScaler类。 - 实例化一个
StandardScaler(),并将其存入变量scaler。 - 从
wineDataFrame 中选择包含Ash、Alcalinity of ash和Magnesium列的子集,赋值给wine_subset。 - 对
wine_subset拟合并变换标准化缩放器。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Import StandardScaler
from sklearn.preprocessing import ____
# Create the scaler
scaler = ____
# Subset the DataFrame you want to scale
____ = wine[[____]]
# Apply the scaler to wine_subset
wine_subset_scaled = scaler.____(____)