CommencerCommencez gratuitement

Estimation à partir des probabilités

L’estimation des paramètres pour les modèles de mélange n’est pas une tâche facile. En revanche, si vous disposez des probabilités d’appartenance à chaque cluster, estimer les moyennes et les proportions des clusters devient plus abordable.

Dans cet exercice, vous utiliserez un jeu de données généré à partir de deux distributions gaussiennes, appelé gaussian_sample_with_probs, qui, dans sa version d’origine, ne contient que la colonne x. Ici, vous disposez également des probabilités pour chaque cluster (prob_cluster1 et prob_cluster2). L’objectif est d’estimer les paramètres, puis de visualiser le mélange estimé.

Cet exercice fait partie du cours

<cours>Modèles de mélange en R</cours>
Voir le cours

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Estimation of the means
___ <- ___ %>% 
  summarise(mean_cluster1= sum(___*prob_cluster1)/sum(prob_cluster1),
            mean_cluster2 = sum(x*___)/sum(___))
means_estimates

# Estimation of the proportions
props_estimates <- ___ %>% 
  summarise(props_cluster1 = ___(prob_cluster1),
            props_cluster2 = 1 - ___)
props_estimates
Modifier et exécuter le code