Gruparea datelor despre pești
Vei folosi acum pipeline-ul de standardizare și grupare din exercițiul anterior pentru a grupa peștii după măsurătorile lor, apoi vei crea un tabel de contingență pentru a compara etichetele de cluster cu speciile de pești.
Ca și înainte, samples este array-ul 2D cu măsurătorile peștilor. Pipeline-ul tău este disponibil ca pipeline, iar specia fiecărui eșantion de pește este dată de lista species.
Acest exercițiu face parte din cursul
Învățare nesupervizată în Python
Instrucțiuni pentru exercițiu
- Importă
pandascu aliasulpd. - Antrenează pipeline-ul pe măsurătorile peștilor din
samples. - Obține etichetele de cluster pentru
samplesfolosind metoda.predict()a obiectuluipipeline. - Folosind
pd.DataFrame(), creează un DataFramedfcu două coloane denumite'labels'și'species', folosind respectivlabelsșispeciespentru valorile coloanelor. - Folosind
pd.crosstab(), creează un tabel de contingențăctdindf['labels']șidf['species'].
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Import pandas
import pandas as pd
# Fit the pipeline to samples
____
# Calculate the cluster labels: labels
labels = ____
# Create a DataFrame with labels and species as columns: df
df = ____
# Create crosstab: ct
ct = ____
# Display ct
print(ct)