找出最大邊界分隔線
回想一下,我們正在處理的資料集,是兩種軟性飲料(一般款與減糖款)各隨機抽取 25 個樣本後所量測的含糖量。在較早的某個圖中,我們辨識出兩個明顯的群集(類別)。當兩個類別之間沒有重疊時,這個資料集稱為可分,而兩類之間由決策邊界分開。最大邊界分隔線是同時距離兩個類別最遠的決策邊界。它位在各類別相關極值點的平均位置上。本例中的相關點,分別是低含糖類別中的最大值,以及高含糖類別中的最小值。本練習要你找出這個含糖量資料集的最大邊界分隔線。
本練習屬於課程
R 的支援向量機
練習說明
- 找出最大邊界分隔線,並指定給變數
mm_separator。 - 參考顯示的圖,找出各類別中相關極端資料點的含糖量數值。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
#The maximal margin separator is at the midpoint of the two extreme points in each cluster.
mm_separator <- (___ + ___)/2