НачатьНачать бесплатно

Влияние начального значения на формирование кластеров

Вы убедились, что начальное значение влияет на результат кластеризации для наборов данных без чётко выраженных групп. В этом упражнении вы проверите, влияет ли начальное значение на кластеры в данных Comic Con, где группы определены чётко.

Данные хранятся в DataFrame библиотеки pandas — comic_con. Столбцы x_scaled и y_scaled содержат стандартизованные координаты X и Y людей в определённый момент времени.

Это упражнение является частью курса

Кластерный анализ на Python

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Import random class
____

# Initialize seed
random.____(____)

# Run kmeans clustering
cluster_centers, distortion = kmeans(comic_con[['x_scaled', 'y_scaled']], 2)
comic_con['cluster_labels'], distortion_list = vq(comic_con[['x_scaled', 'y_scaled']], cluster_centers)

# Plot the scatterplot
sns.scatterplot(x='x_scaled', y='y_scaled', 
                hue='cluster_labels', data = comic_con)
plt.show()
Редактировать и запускать код