Začněte nyníZačněte zdarma

Shlukování dat o rybách

Teď využiješ pipeline pro standardizaci a shlukování z předchozího cvičení k rozdělení ryb do clusterů podle jejich měření a poté vytvoříš křížovou tabulku, která porovná štítky clusterů s druhy ryb.

Jako dříve, samples je 2D pole měření ryb. Pipeline máš k dispozici jako pipeline a druh každé ryby je uložen v seznamu species.

Toto cvičení je součástí kurzu

Unsupervised Learning in Python

Zobrazit kurz

Pokyny k cvičení

  • Importuj pandas jako pd.
  • Natrénuj pipeline na měřeních ryb samples.
  • Získej štítky clusterů pro samples pomocí metody .predict() objektu pipeline.
  • Pomocí pd.DataFrame() vytvoř DataFrame df se dvěma sloupci pojmenovanými 'labels' a 'species', přičemž jako hodnoty sloupců použij labels a species.
  • Pomocí pd.crosstab() vytvoř křížovou tabulku ct z df['labels'] a df['species'].

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Import pandas
import pandas as pd

# Fit the pipeline to samples
____

# Calculate the cluster labels: labels
labels = ____

# Create a DataFrame with labels and species as columns: df
df = ____

# Create crosstab: ct
ct = ____

# Display ct
print(ct)
Upravit a spustit kód