kNN 距離分數
取得 kNN 距離矩陣後,就能為每個點取其最近鄰距離的平均,作為最近鄰距離分數。
距離分數越大,代表該點越可能不尋常或具有異常跡象。
本練習屬於課程
R 中的異常偵測入門
練習說明
- 使用
rowMeans()函式計算 k 個最近鄰的距離分數。 - 印出距離分數最大的那個點的列索引。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Calculate the 5 nearest neighbors distance
wine_nn <- get.knn(wine, k = 5)
# Create score by averaging distances
wine_nnd <- rowMeans(___)
# Print row index of the most anomalous point