Extrahera klusteretiketterna
I föregående övning såg du att den mellanliggande klustring av spannmålsurvalen på höjden 6 innehåller 3 kluster. Använd nu funktionen fcluster() för att extrahera klusteretiketterna för den mellanliggande klustring, och jämför etiketterna med spannmålssorterna med hjälp av en korstabell.
Den hierarkiska klustringen har redan utförts och mergings är resultatet av funktionen linkage(). Listan varieties anger sorten för varje spannmålsurval.
Den här övningen är en del av kursen
Oövervakad inlärning i Python
Övningsinstruktioner
- Importera:
pandassompd.fclusterfrånscipy.cluster.hierarchy.
- Utför en platt hierarkisk klustring med funktionen
fcluster()påmergings. Ange en maximal höjd på6och nyckelordsargumentetcriterion='distance'. - Skapa en DataFrame
dfmed två kolumner som heter'labels'och'varieties', medlabelsrespektivevarietiessom kolumnvärden. Det här steget är redan gjort åt dig. - Skapa en korstabell
ctmellandf['labels']ochdf['varieties']för att räkna hur många gånger varje spannmålssort sammanfaller med varje klusternummer.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Perform the necessary imports
import ____ as ____
from ____ import ____
# Use fcluster to extract labels: labels
labels = ____
# Create a DataFrame with labels and varieties as columns: df
df = pd.DataFrame({'labels': labels, 'varieties': varieties})
# Create crosstab: ct
ct = ____
# Display ct
print(ct)