Kom igångKom igång gratis

Hierarkisk klustring: single-metoden

Låt oss använda samma besöksdataset och se om det uppstår några skillnader när vi använder en annan metod för klustring.

Datan lagras i en pandas DataFrame, comic_con. x_scaled och y_scaled är kolumnnamnen för de standardiserade X- och Y-koordinaterna för personer vid en given tidpunkt.

Den här övningen är en del av kursen

Klusteranalys i Python

Visa kurs

Övningsinstruktioner

  • Importera fcluster och linkage från scipy.cluster.hierarchy.
  • Använd metoden single i funktionen linkage().

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Import the fcluster and linkage functions
from ____ import ____, ____

# Use the linkage() function
distance_matrix = ____(comic_con[[____, ____]], ____ = ____, metric = ____)

# Assign cluster labels
comic_con['cluster_labels'] = ____(____, ____, ____)

# Plot clusters
sns.scatterplot(x='x_scaled', y='y_scaled', 
                hue='cluster_labels', data = comic_con)
plt.show()
Redigera och kör kod