kNN-distanspoäng
När kNN-distansmatrisen är tillgänglig kan närmaste-granne-distanspoängen beräknas genom att ta medelvärdet av närmaste-granne-avstånden för varje punkt.
Stora värden på distanspoängen kan tolkas som att det finns ovanliga eller avvikande punkter i datamängden.
Den här övningen är en del av kursen
Introduktion till avvikelsedetektering i R
Övningsinstruktioner
- Beräkna k-närmaste-granne-distanspoängen med funktionen
rowMeans(). - Skriv ut radindexet för den punkt som har den högsta distanspoängen.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Calculate the 5 nearest neighbors distance
wine_nn <- get.knn(wine, k = 5)
# Create score by averaging distances
wine_nnd <- rowMeans(___)
# Print row index of the most anomalous point