Extragerea etichetelor de cluster
În exercițiul anterior, ai văzut că clustering-ul intermediar al eșantioanelor de cereale la înălțimea 6 conține 3 clustere. Acum, folosește funcția fcluster() pentru a extrage etichetele de cluster ale acestui clustering intermediar și compară etichetele cu varietățile de cereale folosind un tabel încrucișat.
Clustering-ul ierarhic a fost deja efectuat, iar mergings este rezultatul funcției linkage(). Lista varieties indică varietatea fiecărui eșantion de cereale.
Acest exercițiu face parte din cursul
Învățare nesupervizată în Python
Instrucțiuni pentru exercițiu
- Importă:
pandascapd.fclusterdinscipy.cluster.hierarchy.
- Realizează un clustering ierarhic plat folosind funcția
fcluster()aplicată pemergings. Specifică o înălțime maximă de6și argumentul cheiecriterion='distance'. - Creează un DataFrame
dfcu două coloane numite'labels'și'varieties', folosindlabels, respectivvarieties, pentru valorile coloanelor. Acest pas a fost deja realizat pentru tine. - Creează un tabel încrucișat
ctîntredf['labels']șidf['varieties']pentru a număra de câte ori fiecare varietate de cereale coincide cu fiecare etichetă de cluster.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Perform the necessary imports
import ____ as ____
from ____ import ____
# Use fcluster to extract labels: labels
labels = ____
# Create a DataFrame with labels and varieties as columns: df
df = pd.DataFrame({'labels': labels, 'varieties': varieties})
# Create crosstab: ct
ct = ____
# Display ct
print(ct)