अलग-अलग क्लस्टर्स पर seed का प्रभाव
आपने ऐसे डेटासेट पर seed के प्रभाव देखे थे जिसमें क्लस्टर्स के समूह स्पष्ट नहीं थे। इस अभ्यास में, आप जाँचेंगे कि जहाँ क्लस्टर्स स्पष्ट रूप से परिभाषित हैं — Comic Con डेटा — वहाँ भी क्या seeds क्लस्टर्स को प्रभावित करते हैं।
डेटा एक pandas DataFrame comic_con में संग्रहीत है। x_scaled और y_scaled वे कॉलम नाम हैं जिनमें किसी समय बिंदु पर लोगों के standardized X और Y coordinates हैं।
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में क्लस्टर विश्लेषण
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Import random class
____
# Initialize seed
random.____(____)
# Run kmeans clustering
cluster_centers, distortion = kmeans(comic_con[['x_scaled', 'y_scaled']], 2)
comic_con['cluster_labels'], distortion_list = vq(comic_con[['x_scaled', 'y_scaled']], cluster_centers)
# Plot the scatterplot
sns.scatterplot(x='x_scaled', y='y_scaled',
hue='cluster_labels', data = comic_con)
plt.show()