Regrouper les données sur les poissons
Vous allez maintenant réutiliser votre pipeline de normalisation et de regroupement de l'exercice précédent pour regrouper les poissons selon leurs mesures, puis créer une table croisée afin de comparer les étiquettes de clusters aux espèces de poissons.
Comme précédemment, samples est le tableau 2D des mesures des poissons. Votre pipeline est disponible sous le nom pipeline, et l'espèce de chaque échantillon de poisson est fournie par la liste species.
Cette activité fait partie du cours
Unsupervised Learning in Python
Instructions de l’exercice
- Importez
pandassous le nompd. - Ajustez le pipeline aux mesures des poissons
samples. - Obtenez les étiquettes de clusters pour
samplesà l'aide de la méthode.predict()depipeline. - Avec
pd.DataFrame(), créez un DataFramedfcomportant deux colonnes nommées'labels'et'species', en utilisant respectivementlabelsetspeciescomme valeurs de colonnes. - Avec
pd.crosstab(), créez une table croiséectdedf['labels']etdf['species'].
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Import pandas
import pandas as pd
# Fit the pipeline to samples
____
# Calculate the cluster labels: labels
labels = ____
# Create a DataFrame with labels and species as columns: df
df = ____
# Create crosstab: ct
ct = ____
# Display ct
print(ct)