Score de distance kNN
Une fois la matrice des distances kNN disponible, le score de distance du plus proche voisin peut être calculé en moyennant les distances aux plus proches voisins pour chaque point.
Des valeurs élevées du score de distance peuvent indiquer la présence de points inhabituels ou anormaux.
Cet exercice fait partie du cours
<cours>Introduction à la détection d’anomalies en R</cours>Instructions de l’exercice
- Calculez le score de distance des k plus proches voisins avec la fonction
rowMeans(). - Affichez l’indice de ligne du point ayant le score de distance le plus élevé.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Calculate the 5 nearest neighbors distance
wine_nn <- get.knn(wine, k = 5)
# Create score by averaging distances
wine_nnd <- rowMeans(___)
# Print row index of the most anomalous point