kNN-Distanz-Score
Sobald die kNN-Distanzmatrix vorliegt, lässt sich der Distanz-Score der nächsten Nachbarn berechnen, indem du die nächstgelegenen Nachbardistanzen für jeden Punkt mittlest.
Große Werte des Distanz-Scores können als Hinweis auf das Vorhandensein ungewöhnlicher oder anomaler Punkte interpretiert werden.
Diese Übung ist Teil des Kurses
<Kurs>Einführung in die Anomalieerkennung in R</Kurs>Übungsanweisungen
- Berechne den k-nearest-neighbor-Distanz-Score mit der Funktion
rowMeans(). - Gib den Zeilenindex des Punkts mit dem größten Distanz-Score aus.
Interaktive praktische Übung
Versuche dich an dieser Übung, indem du diesen Beispielcode vervollständigst.
# Calculate the 5 nearest neighbors distance
wine_nn <- get.knn(wine, k = 5)
# Create score by averaging distances
wine_nnd <- rowMeans(___)
# Print row index of the most anomalous point