Shlukování dat o rybách
Teď využiješ pipeline pro standardizaci a shlukování z předchozího cvičení k rozdělení ryb do clusterů podle jejich měření a poté vytvoříš křížovou tabulku, která porovná štítky clusterů s druhy ryb.
Jako dříve, samples je 2D pole měření ryb. Pipeline máš k dispozici jako pipeline a druh každé ryby je uložen v seznamu species.
Toto cvičení je součástí kurzu
Unsupervised Learning in Python
Pokyny k cvičení
- Importuj
pandasjakopd. - Natrénuj pipeline na měřeních ryb
samples. - Získej štítky clusterů pro
samplespomocí metody.predict()objektupipeline. - Pomocí
pd.DataFrame()vytvoř DataFramedfse dvěma sloupci pojmenovanými'labels'a'species', přičemž jako hodnoty sloupců použijlabelsaspecies. - Pomocí
pd.crosstab()vytvoř křížovou tabulkuctzdf['labels']adf['species'].
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Import pandas
import pandas as pd
# Fit the pipeline to samples
____
# Calculate the cluster labels: labels
labels = ____
# Create a DataFrame with labels and species as columns: df
df = ____
# Create crosstab: ct
ct = ____
# Display ct
print(ct)