視覺化糖含量資料集
在這個練習中,你會建立一個 1 維散佈圖,呈現 25 個軟性飲料的糖含量量測值。目標是把資料集中的明顯群聚視覺化,作為找出候選決策邊界的第一步。
包含 25 個糖含量量測值的資料集已儲存在資料框 df 的 sugar_content 欄位中,系統已為你預先載入。
本練習屬於課程
R 的支援向量機
練習說明
- 載入
ggplot2套件。 - 列出資料框
df的變數。 - 完成散佈圖程式碼。使用資料集
df,將樣本的糖含量畫在 x 軸上(y 軸固定為 0)。 - 撰寫
ggplot()程式碼,將df中的糖含量顯示為散佈圖。你能否看出對應於高糖與低糖樣本的兩個明顯群聚?
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Load ggplot2
___
# Print variable names
___
# Plot sugar content along the x-axis
plot_df <- ggplot(data = __, aes(x = ___, y = ___)) +
geom_point() +
geom_text(aes(label = sugar_content), size = 2.5, vjust = 2, hjust = 0.5)
# Display plot
plot_df