Kom igångKom igång gratis

Extrahera klusteretiketterna

I föregående övning såg du att den mellanliggande klustring av spannmålsurvalen på höjden 6 innehåller 3 kluster. Använd nu funktionen fcluster() för att extrahera klusteretiketterna för den mellanliggande klustring, och jämför etiketterna med spannmålssorterna med hjälp av en korstabell.

Den hierarkiska klustringen har redan utförts och mergings är resultatet av funktionen linkage(). Listan varieties anger sorten för varje spannmålsurval.

Den här övningen är en del av kursen

Oövervakad inlärning i Python

Visa kurs

Övningsinstruktioner

  • Importera:
    • pandas som pd.
    • fcluster från scipy.cluster.hierarchy.
  • Utför en platt hierarkisk klustring med funktionen fcluster()mergings. Ange en maximal höjd på 6 och nyckelordsargumentet criterion='distance'.
  • Skapa en DataFrame df med två kolumner som heter 'labels' och 'varieties', med labels respektive varieties som kolumnvärden. Det här steget är redan gjort åt dig.
  • Skapa en korstabell ct mellan df['labels'] och df['varieties'] för att räkna hur många gånger varje spannmålssort sammanfaller med varje klusternummer.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Perform the necessary imports
import ____ as ____
from ____ import ____

# Use fcluster to extract labels: labels
labels = ____

# Create a DataFrame with labels and varieties as columns: df
df = pd.DataFrame({'labels': labels, 'varieties': varieties})

# Create crosstab: ct
ct = ____

# Display ct
print(ct)
Redigera och kör kod