ÎncepețiÎncepe gratuit

Gruparea datelor despre pești

Vei folosi acum pipeline-ul de standardizare și grupare din exercițiul anterior pentru a grupa peștii după măsurătorile lor, apoi vei crea un tabel de contingență pentru a compara etichetele de cluster cu speciile de pești.

Ca și înainte, samples este array-ul 2D cu măsurătorile peștilor. Pipeline-ul tău este disponibil ca pipeline, iar specia fiecărui eșantion de pește este dată de lista species.

Acest exercițiu face parte din cursul

Învățare nesupervizată în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Importă pandas cu aliasul pd.
  • Antrenează pipeline-ul pe măsurătorile peștilor din samples.
  • Obține etichetele de cluster pentru samples folosind metoda .predict() a obiectului pipeline.
  • Folosind pd.DataFrame(), creează un DataFrame df cu două coloane denumite 'labels' și 'species', folosind respectiv labels și species pentru valorile coloanelor.
  • Folosind pd.crosstab(), creează un tabel de contingență ct din df['labels'] și df['species'].

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Import pandas
import pandas as pd

# Fit the pipeline to samples
____

# Calculate the cluster labels: labels
labels = ____

# Create a DataFrame with labels and species as columns: df
df = ____

# Create crosstab: ct
ct = ____

# Display ct
print(ct)
Editează și rulează codul