Klastrowanie danych o rybach
Teraz użyjesz potoku standaryzacji i klastrowania z poprzedniego ćwiczenia, aby pogrupować ryby na podstawie ich pomiarów, a następnie utworzysz tabelę krzyżową porównującą etykiety klastrów z gatunkami ryb.
Podobnie jak wcześniej, samples to dwuwymiarowa tablica pomiarów ryb. Potok jest dostępny jako pipeline, a gatunek każdej próbki ryby jest podany na liście species.
To ćwiczenie jest częścią kursu
Uczenie nienadzorowane w Pythonie
Instrukcje do ćwiczenia
- Zaimportuj
pandasjakopd. - Dopasuj potok do pomiarów ryb
samples. - Uzyskaj etykiety klastrów dla
samples, używając metody.predict()obiektupipeline. - Za pomocą
pd.DataFrame()utwórz DataFramedfz dwiema kolumnami o nazwach'labels'i'species', używając odpowiedniolabelsispeciesjako wartości kolumn. - Za pomocą
pd.crosstab()utwórz tabelę krzyżowąctzdf['labels']idf['species'].
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Import pandas
import pandas as pd
# Fit the pipeline to samples
____
# Calculate the cluster labels: labels
labels = ____
# Create a DataFrame with labels and species as columns: df
df = ____
# Create crosstab: ct
ct = ____
# Display ct
print(ct)