Skattning givet sannolikheterna
Parameterskattning för blandningsmodeller är ingen enkel uppgift. Men om du känner till sannolikheterna för tillhörighet till varje kluster är det inte så svårt att skatta medelvärden och proportioner.
I den här övningen använder du en datamängd skapad av två Gaussfördelningar, kallad gaussian_sample_with_probs. I sin ursprungliga form innehåller den bara kolumnen x, men här får du även sannolikheterna för varje kluster (prob_cluster1 och prob_cluster2). Målet är att skatta parametrarna och sedan visualisera den skattade blandningen.
Den här övningen är en del av kursen
Blandningsmodeller i R
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Estimation of the means
___ <- ___ %>%
summarise(mean_cluster1= sum(___*prob_cluster1)/sum(prob_cluster1),
mean_cluster2 = sum(x*___)/sum(___))
means_estimates
# Estimation of the proportions
props_estimates <- ___ %>%
summarise(props_cluster1 = ___(prob_cluster1),
props_cluster2 = 1 - ___)
props_estimates