Comparer les résultats
Nous avons vu qu’un modèle de mélange attribue à chaque observation une probabilité d’appartenir à chacun des clusters. Toutefois, si vous souhaitez affecter chaque observation au cluster dont la probabilité est maximale, vous pouvez utiliser la fonction clusters() du package flexmix.
Comme le jeu de données mix_example est issu d’une simulation, nous disposons des vraies étiquettes pour chaque observation. Elles sont fournies dans la variable assignment. L’objectif de cet exercice est de comparer les étiquettes attribuées par la fonction clusters() aux affectations réelles.
Cet exercice fait partie du cours
<cours>Modèles de mélange en R</cours>Instructions de l’exercice
- Affichez les six premiers éléments du résultat de
clusters(). - Affichez les six premiers éléments des vraies étiquettes.
- Utilisez la fonction
table()pour créer un tableau de fréquences où les lignes correspondent aux vraies étiquettes et les colonnes aux étiquettes prédites.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Explore the first assignments
___(___(fit_mix_example))
# Explore the first real labels
___(mix_example$___)
# Create frequency table
___(___, clusters(fit_mix_example))