Začněte nyníZačněte zdarma

Vliv seeds na výsledné shluky

Viděl/a jsi, jaký vliv mají seeds na dataset bez jasně oddělených shluků. V tomto cvičení prozkoumáš, jestli seeds ovlivňují shluky i v datech z Comic Conu, kde jsou shluky dobře definované.

Data jsou uložena v pandas DataFrame comic_con. x_scaled a y_scaled jsou názvy sloupců se standardizovanými souřadnicemi X a Y lidí v daném okamžiku.

Toto cvičení je součástí kurzu

Cluster Analysis in Python

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Import random class
____

# Initialize seed
random.____(____)

# Run kmeans clustering
cluster_centers, distortion = kmeans(comic_con[['x_scaled', 'y_scaled']], 2)
comic_con['cluster_labels'], distortion_list = vq(comic_con[['x_scaled', 'y_scaled']], cluster_centers)

# Plot the scatterplot
sns.scatterplot(x='x_scaled', y='y_scaled', 
                hue='cluster_labels', data = comic_con)
plt.show()
Upravit a spustit kód