Zacznij terazZacznij za darmo

Klastrowanie danych o rybach

Teraz użyjesz potoku standaryzacji i klastrowania z poprzedniego ćwiczenia, aby pogrupować ryby na podstawie ich pomiarów, a następnie utworzysz tabelę krzyżową porównującą etykiety klastrów z gatunkami ryb.

Podobnie jak wcześniej, samples to dwuwymiarowa tablica pomiarów ryb. Potok jest dostępny jako pipeline, a gatunek każdej próbki ryby jest podany na liście species.

To ćwiczenie jest częścią kursu

Uczenie nienadzorowane w Pythonie

Zobacz kurs

Instrukcje do ćwiczenia

  • Zaimportuj pandas jako pd.
  • Dopasuj potok do pomiarów ryb samples.
  • Uzyskaj etykiety klastrów dla samples, używając metody .predict() obiektu pipeline.
  • Za pomocą pd.DataFrame() utwórz DataFrame df z dwiema kolumnami o nazwach 'labels' i 'species', używając odpowiednio labels i species jako wartości kolumn.
  • Za pomocą pd.crosstab() utwórz tabelę krzyżową ct z df['labels'] i df['species'].

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Import pandas
import pandas as pd

# Fit the pipeline to samples
____

# Calculate the cluster labels: labels
labels = ____

# Create a DataFrame with labels and species as columns: df
df = ____

# Create crosstab: ct
ct = ____

# Display ct
print(ct)
Edytuj i uruchom kod