Indice de distance kNN
Une fois la matrice des distances kNN disponible, on peut calculer l'indice de distance du plus proche voisin en faisant la moyenne des distances des plus proches voisins pour chaque point.
De grandes valeurs de cet indice peuvent indiquer la présence de points inhabituels ou anormaux.
Cette activité fait partie du cours
Introduction à la détection d'anomalies en R
Instructions de l’exercice
- Calculez l'indice de distance des k plus proches voisins à l'aide de la fonction
rowMeans(). - Affichez l'indice de ligne du point ayant la plus grande valeur de l'indice de distance.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Calculate the 5 nearest neighbors distance
wine_nn <- get.knn(wine, k = 5)
# Create score by averaging distances
wine_nnd <- rowMeans(___)
# Print row index of the most anomalous point