Estimation à partir des probabilités
L’estimation des paramètres pour les modèles de mélange n’est pas une tâche facile. En revanche, si vous disposez des probabilités d’appartenance à chaque cluster, estimer les moyennes et les proportions des clusters devient plus abordable.
Dans cet exercice, vous utiliserez un jeu de données généré à partir de deux distributions gaussiennes, appelé gaussian_sample_with_probs, qui, dans sa version d’origine, ne contient que la colonne x. Ici, vous disposez également des probabilités pour chaque cluster (prob_cluster1 et prob_cluster2). L’objectif est d’estimer les paramètres, puis de visualiser le mélange estimé.
Cet exercice fait partie du cours
<cours>Modèles de mélange en R</cours>Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Estimation of the means
___ <- ___ %>%
summarise(mean_cluster1= sum(___*prob_cluster1)/sum(prob_cluster1),
mean_cluster2 = sum(x*___)/sum(___))
means_estimates
# Estimation of the proportions
props_estimates <- ___ %>%
summarise(props_cluster1 = ___(prob_cluster1),
props_cluster2 = 1 - ___)
props_estimates