ПочатиПочніть безкоштовно

Вплив зерен (seed) на окремі кластери

Ви помітили вплив початкових зерен на набір даних, у якому групи кластерів були нечітко визначені. У цій вправі ви дослідите, чи впливають зерна на кластери в даних Comic Con, де кластери чітко відокремлені.

Дані збережено в датафреймі pandas comic_con. x_scaled і y_scaled — це назви стовпців зі стандартизованими координатами X та Y людей у певний момент часу.

Ця вправа є частиною курсу

Кластерний аналіз у Python

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Import random class
____

# Initialize seed
random.____(____)

# Run kmeans clustering
cluster_centers, distortion = kmeans(comic_con[['x_scaled', 'y_scaled']], 2)
comic_con['cluster_labels'], distortion_list = vq(comic_con[['x_scaled', 'y_scaled']], cluster_centers)

# Plot the scatterplot
sns.scatterplot(x='x_scaled', y='y_scaled', 
                hue='cluster_labels', data = comic_con)
plt.show()
Редагувати та запускати код