Comparer les résultats
Nous avons vu qu'un modèle de mélange attribue à chaque observation une probabilité d'appartenir à chacun des groupes. Toutefois, si vous voulez affecter chaque observation au groupe pour lequel la probabilité est maximale, vous pouvez utiliser la fonction clusters() du paquet flexmix.
Comme l'ensemble de données mix_example provient d'une simulation, nous avons en fait les vraies étiquettes pour chaque observation. Elles sont fournies dans la variable assignment. L'objectif de cet exercice est de comparer les étiquettes attribuées par la fonction clusters() aux affectations réelles.
Cette activité fait partie du cours
Modèles de mélange en R
Instructions de l’exercice
- Explorez les six premiers éléments retournés par la fonction
clusters(). - Explorez les six premiers éléments des vraies étiquettes.
- Utilisez la fonction
table()pour créer un tableau de fréquences où les lignes correspondent aux vraies étiquettes et les colonnes à l'étiquette prédite.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Explore the first assignments
___(___(fit_mix_example))
# Explore the first real labels
___(mix_example$___)
# Create frequency table
___(___, clusters(fit_mix_example))