Extraire les étiquettes de grappes
Dans l'exercice précédent, vous avez vu que le regroupement intermédiaire des échantillons de grains à la hauteur 6 comporte 3 grappes. Maintenant, utilisez la fonction fcluster() pour extraire les étiquettes de grappes pour ce regroupement intermédiaire, puis comparez ces étiquettes aux variétés de grains à l'aide d'un tableau croisé.
Le regroupement hiérarchique a déjà été effectué et mergings est le résultat de la fonction linkage(). La liste varieties donne la variété de chaque échantillon de grain.
Cette activité fait partie du cours
Unsupervised Learning in Python
Instructions de l’exercice
- Importez :
pandassous le nompd.fclusterdepuisscipy.cluster.hierarchy.
- Effectuez un regroupement hiérarchique aplati en utilisant la fonction
fcluster()surmergings. Indiquez une hauteur maximale de6et l'argument nommécriterion='distance'. - Créez un DataFrame
dfavec deux colonnes nommées'labels'et'varieties', en utilisant respectivementlabelsetvarietiescomme valeurs de colonnes. Cela a été fait pour vous. - Créez un tableau croisé
ctentredf['labels']etdf['varieties']pour compter le nombre de fois où chaque variété de grain correspond à chaque étiquette de grappe.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Perform the necessary imports
import ____ as ____
from ____ import ____
# Use fcluster to extract labels: labels
labels = ____
# Create a DataFrame with labels and varieties as columns: df
df = pd.DataFrame({'labels': labels, 'varieties': varieties})
# Create crosstab: ct
ct = ____
# Display ct
print(ct)