開始使用免費開始

找出最大邊界分隔線

回想一下,我們正在處理的資料集,是兩種軟性飲料(一般款與減糖款)各隨機抽取 25 個樣本後所量測的含糖量。在較早的某個圖中,我們辨識出兩個明顯的群集(類別)。當兩個類別之間沒有重疊時,這個資料集稱為可分,而兩類之間由決策邊界分開。最大邊界分隔線是同時距離兩個類別最遠的決策邊界。它位在各類別相關極值點的平均位置上。本例中的相關點,分別是低含糖類別中的最大值,以及高含糖類別中的最小值。本練習要你找出這個含糖量資料集的最大邊界分隔線。

本練習屬於課程

R 的支援向量機

檢視課程

練習說明

  • 找出最大邊界分隔線,並指定給變數 mm_separator
  • 參考顯示的圖,找出各類別中相關極端資料點的含糖量數值。

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

#The maximal margin separator is at the midpoint of the two extreme points in each cluster.
mm_separator <- (___ + ___)/2
編輯並執行程式碼