मैक्सिमल मार्जिन सेपरेटर खोजें
याद कीजिए, जिस डेटासेट पर हम काम कर रहे हैं, वह दो सॉफ्ट ड्रिंक्स के 25 रैंडम चुने गए सैंपल्स की शुगर कंटेंट मापों से बना है — एक रेगुलर और दूसरा रिड्यूस्ड शुगर। हमारी एक पहले की प्लॉट में, हमें दो अलग-अलग क्लस्टर्स (क्लासेज) दिखे। ऐसा डेटासेट जिसमें क्लासेज एक-दूसरे से ओवरलैप नहीं करतीं, separable कहलाता है, और क्लासेज के बीच की रेखा को decision boundary कहते हैं। maximal margin separator वह decision boundary है जो दोनों क्लासेज से सबसे अधिक दूरी पर होती है। यह प्रत्येक क्लास के प्रासंगिक चरम बिंदुओं के औसत (mean) पर स्थित होती है। इस मामले में प्रासंगिक बिंदु हैं: कम चीनी वाली क्लास का सबसे बड़ा मान और अधिक चीनी वाली क्लास का सबसे छोटा मान। इस अभ्यास में आपसे शुगर कंटेंट डेटासेट के लिए maximal margin separator खोजने को कहा गया है।
यह अभ्यास पाठ्यक्रम का हिस्सा है
R में Support Vector Machines
अभ्यास निर्देश
- maximal margin separator ढूँढ़ें और उसे वैरिएबल
mm_separatorको असाइन करें। - दिखाए गए प्लॉट का उपयोग करके, प्रत्येक क्लास के प्रासंगिक चरम डेटा बिंदुओं के शुगर कंटेंट मान निकालें।
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
#The maximal margin separator is at the midpoint of the two extreme points in each cluster.
mm_separator <- (___ + ___)/2