Odhad parametrů při znalosti pravděpodobností
Odhadovat parametry směsných modelů není jednoduché. Pokud ale znáš pravděpodobnosti příslušnosti ke každému klastru, odhad středních hodnot a proporcí klastrů už tak složitý není.
V tomto cvičení použiješ datovou sadu vytvořenou ze dvou Gaussových rozdělení s názvem gaussian_sample_with_probs. V základní podobě obsahuje pouze sloupec x, zde ale máš k dispozici i pravděpodobnosti pro každý klastr (prob_cluster1 a prob_cluster2). Cílem je odhadnout parametry a pak vizualizovat odhadovanou směs.
Toto cvičení je součástí kurzu
Mixture Models v R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Estimation of the means
___ <- ___ %>%
summarise(mean_cluster1= sum(___*prob_cluster1)/sum(prob_cluster1),
mean_cluster2 = sum(x*___)/sum(___))
means_estimates
# Estimation of the proportions
props_estimates <- ___ %>%
summarise(props_cluster1 = ___(prob_cluster1),
props_cluster2 = 1 - ___)
props_estimates