可视化含糖量数据集
在本练习中,您将为 25 个软饮料含糖量测量值创建一幅一维散点图。目标是先可视化数据集中的不同簇,为后续识别候选决策边界做准备。
包含 25 个含糖量测量值的数据集存放在数据框 df 的 sugar_content 列中,已为您预先加载。
本练习是课程的一部分
R 中的支持向量机
练习说明
- 加载
ggplot2包。 - 列出数据框
df中的变量。 - 补全散点图代码。使用数据集
df,在 x 轴上绘制样本的含糖量(y 取 0)。 - 编写
ggplot()代码,将df中的含糖量以散点图显示。您能否看出对应于高含糖和低含糖样本的两个明显簇?
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Load ggplot2
___
# Print variable names
___
# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) +
geom_point() +
geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)
# Display plot
plot_df