CommencezCommencez gratuitement

Indice de distance kNN

Une fois la matrice des distances kNN disponible, on peut calculer l'indice de distance du plus proche voisin en faisant la moyenne des distances des plus proches voisins pour chaque point.

De grandes valeurs de cet indice peuvent indiquer la présence de points inhabituels ou anormaux.

Cette activité fait partie du cours

Introduction à la détection d'anomalies en R

Voir le cours

Instructions de l’exercice

  • Calculez l'indice de distance des k plus proches voisins à l'aide de la fonction rowMeans().
  • Affichez l'indice de ligne du point ayant la plus grande valeur de l'indice de distance.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Calculate the 5 nearest neighbors distance
wine_nn <- get.knn(wine, k = 5)

# Create score by averaging distances
wine_nnd <- rowMeans(___)

# Print row index of the most anomalous point
Modifier et exécuter le code