Beräkna sannolikheterna
I den förra övningen såg du hur man kan skatta medelvärden och proportioner när sannolikheterna är kända. Syftet med den här övningen är att skatta sannolikheterna när medelvärden och proportioner är kända. Anta att medelvärdena för kluster 1 och 2 är 10 respektive 50, och att kluster 1 utgör 35 procent av populationen.
Eftersom vi enbart fokuserar på parameterestimering antar vi att båda sd är 10. Datamängden gaussian_sample finns tillgänglig i din arbetsmiljö.
Den här övningen är en del av kursen
Blandningsmodeller i R
Övningsinstruktioner
- Skapa en ny dataram med namnet
gaussian_sample_with_probssom innehåller skattningarna av sannolikheterna för kluster 1 och 2. Skapa för detta ändamål två nya variabler:prob_cluster1ochprob_cluster2. Kom ihåg att skala sannolikheterna. - Titta på de första 6 observationerna i
gaussian_sample_with_probs.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create data frame with probabilities
gaussian_sample_with_probs <- gaussian_sample %>%
___(prob_from_cluster1 = 0.35 * ___(___, mean = 10, sd = 10),
prob_from_cluster2 = 0.65 * dnorm(___, mean = 50, sd = 10),
prob_cluster1 = ___/(prob_from_cluster1 + prob_from_cluster2),
prob_cluster2 = ___/(prob_from_cluster1 + prob_from_cluster2)) %>%
select(x, prob_cluster1, prob_cluster2)
head(___)