CommencezCommencez gratuitement

Extraire les étiquettes de grappes

Dans l'exercice précédent, vous avez vu que le regroupement intermédiaire des échantillons de grains à la hauteur 6 comporte 3 grappes. Maintenant, utilisez la fonction fcluster() pour extraire les étiquettes de grappes pour ce regroupement intermédiaire, puis comparez ces étiquettes aux variétés de grains à l'aide d'un tableau croisé.

Le regroupement hiérarchique a déjà été effectué et mergings est le résultat de la fonction linkage(). La liste varieties donne la variété de chaque échantillon de grain.

Cette activité fait partie du cours

Unsupervised Learning in Python

Voir le cours

Instructions de l’exercice

  • Importez :
    • pandas sous le nom pd.
    • fcluster depuis scipy.cluster.hierarchy.
  • Effectuez un regroupement hiérarchique aplati en utilisant la fonction fcluster() sur mergings. Indiquez une hauteur maximale de 6 et l'argument nommé criterion='distance'.
  • Créez un DataFrame df avec deux colonnes nommées 'labels' et 'varieties', en utilisant respectivement labels et varieties comme valeurs de colonnes. Cela a été fait pour vous.
  • Créez un tableau croisé ct entre df['labels'] et df['varieties'] pour compter le nombre de fois où chaque variété de grain correspond à chaque étiquette de grappe.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Perform the necessary imports
import ____ as ____
from ____ import ____

# Use fcluster to extract labels: labels
labels = ____

# Create a DataFrame with labels and varieties as columns: df
df = pd.DataFrame({'labels': labels, 'varieties': varieties})

# Create crosstab: ct
ct = ____

# Display ct
print(ct)
Modifier et exécuter le code