ÎncepețiÎncepe gratuit

Extragerea etichetelor de cluster

În exercițiul anterior, ai văzut că clustering-ul intermediar al eșantioanelor de cereale la înălțimea 6 conține 3 clustere. Acum, folosește funcția fcluster() pentru a extrage etichetele de cluster ale acestui clustering intermediar și compară etichetele cu varietățile de cereale folosind un tabel încrucișat.

Clustering-ul ierarhic a fost deja efectuat, iar mergings este rezultatul funcției linkage(). Lista varieties indică varietatea fiecărui eșantion de cereale.

Acest exercițiu face parte din cursul

Învățare nesupervizată în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Importă:
    • pandas ca pd.
    • fcluster din scipy.cluster.hierarchy.
  • Realizează un clustering ierarhic plat folosind funcția fcluster() aplicată pe mergings. Specifică o înălțime maximă de 6 și argumentul cheie criterion='distance'.
  • Creează un DataFrame df cu două coloane numite 'labels' și 'varieties', folosind labels, respectiv varieties, pentru valorile coloanelor. Acest pas a fost deja realizat pentru tine.
  • Creează un tabel încrucișat ct între df['labels'] și df['varieties'] pentru a număra de câte ori fiecare varietate de cereale coincide cu fiecare etichetă de cluster.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Perform the necessary imports
import ____ as ____
from ____ import ____

# Use fcluster to extract labels: labels
labels = ____

# Create a DataFrame with labels and varieties as columns: df
df = pd.DataFrame({'labels': labels, 'varieties': varieties})

# Create crosstab: ct
ct = ____

# Display ct
print(ct)
Editează și rulează codul