Extrakce štítků shluků
V předchozím cvičení jsi viděl/a, že mezilehlé shlukování vzorků zrní ve výšce 6 obsahuje 3 shluky. Teď použij funkci fcluster() k extrakci štítků shluků pro toto mezilehlé shlukování a porovnej štítky s odrůdami zrní pomocí křížové tabulky.
Hierarchické shlukování už bylo provedeno a mergings je výsledek funkce linkage(). Seznam varieties udává odrůdu každého vzorku zrní.
Toto cvičení je součástí kurzu
Unsupervised Learning in Python
Pokyny k cvičení
- Importuj:
pandasjakopd.fclusterzscipy.cluster.hierarchy.
- Proveď flat hierarchické shlukování pomocí funkce
fcluster()namergings. Zadej maximální výšku6a klíčový argumentcriterion='distance'. - Vytvoř DataFrame
dfse dvěma sloupci pojmenovanými'labels'a'varieties', přičemž jako hodnoty sloupců použijlabelsavarieties. Tento krok už byl proveden za tebe. - Vytvoř křížovou tabulku
ctmezidf['labels']adf['varieties'], která spočítá, kolikrát se každá odrůda zrní shoduje s každým štítkem shluku.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Perform the necessary imports
import ____ as ____
from ____ import ____
# Use fcluster to extract labels: labels
labels = ____
# Create a DataFrame with labels and varieties as columns: df
df = pd.DataFrame({'labels': labels, 'varieties': varieties})
# Create crosstab: ct
ct = ____
# Display ct
print(ct)