Estimarea parametrilor pe baza probabilităților
Estimarea parametrilor pentru modelele de amestec nu este o sarcină ușoară. Însă dacă dispui de probabilitățile de apartenență la fiecare cluster, estimarea mediilor și a proporțiilor devine mai accesibilă.
În acest exercițiu, vei folosi un set de date creat din două distribuții Gaussiene, numit gaussian_sample_with_probs. În forma sa originală, acesta conține doar coloana x, dar aici ai la dispoziție și probabilitățile pentru fiecare cluster (prob_cluster1 și prob_cluster2). Scopul este să estimezi parametrii și apoi să vizualizezi amestecul estimat.
Acest exercițiu face parte din cursul
Mixture Models în R
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Estimation of the means
___ <- ___ %>%
summarise(mean_cluster1= sum(___*prob_cluster1)/sum(prob_cluster1),
mean_cluster2 = sum(x*___)/sum(___))
means_estimates
# Estimation of the proportions
props_estimates <- ___ %>%
summarise(props_cluster1 = ___(prob_cluster1),
props_cluster2 = 1 - ___)
props_estimates