ÎncepețiÎncepe gratuit

Impactul seed-urilor asupra clusterelor distincte

Ai observat impactul seed-urilor asupra unui set de date fără grupuri de clustere bine definite. În acest exercițiu, vei explora dacă seed-urile influențează clusterele din datele Comic Con, unde clusterele sunt bine definite.

Datele sunt stocate într-un DataFrame pandas, comic_con. x_scaled și y_scaled sunt numele coloanelor pentru coordonatele X și Y standardizate ale persoanelor la un moment dat.

Acest exercițiu face parte din cursul

Analiza clusterelor în Python

Vezi cursul

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Import random class
____

# Initialize seed
random.____(____)

# Run kmeans clustering
cluster_centers, distortion = kmeans(comic_con[['x_scaled', 'y_scaled']], 2)
comic_con['cluster_labels'], distortion_list = vq(comic_con[['x_scaled', 'y_scaled']], cluster_centers)

# Plot the scatterplot
sns.scatterplot(x='x_scaled', y='y_scaled', 
                hue='cluster_labels', data = comic_con)
plt.show()
Editează și rulează codul