계층적 클러스터링: single 방법
같은 footfall 데이터셋을 사용해서, 다른 방법으로 클러스터링했을 때 변화가 있는지 확인해 봅시다.
데이터는 pandas DataFrame인 comic_con에 저장되어 있어요. x_scaled와 y_scaled는 특정 시점에서 사람들의 표준화된 X, Y 좌표 컬럼 이름입니다.
이 연습은 강의의 일부입니다
Python으로 배우는 군집 분석
연습 안내
scipy.cluster.hierarchy에서fcluster와linkage를 가져오세요.linkage()함수에서single방법을 사용하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Import the fcluster and linkage functions
from ____ import ____, ____
# Use the linkage() function
distance_matrix = ____(comic_con[[____, ____]], ____ = ____, metric = ____)
# Assign cluster labels
comic_con['cluster_labels'] = ____(____, ____, ____)
# Plot clusters
sns.scatterplot(x='x_scaled', y='y_scaled',
hue='cluster_labels', data = comic_con)
plt.show()