Kom igångKom igång gratis

Beräkna sannolikheterna

I den förra övningen såg du hur man kan skatta medelvärden och proportioner när sannolikheterna är kända. Syftet med den här övningen är att skatta sannolikheterna när medelvärden och proportioner är kända. Anta att medelvärdena för kluster 1 och 2 är 10 respektive 50, och att kluster 1 utgör 35 procent av populationen.

Eftersom vi enbart fokuserar på parameterestimering antar vi att båda sd är 10. Datamängden gaussian_sample finns tillgänglig i din arbetsmiljö.

Den här övningen är en del av kursen

Blandningsmodeller i R

Visa kurs

Övningsinstruktioner

  • Skapa en ny dataram med namnet gaussian_sample_with_probs som innehåller skattningarna av sannolikheterna för kluster 1 och 2. Skapa för detta ändamål två nya variabler: prob_cluster1 och prob_cluster2. Kom ihåg att skala sannolikheterna.
  • Titta på de första 6 observationerna i gaussian_sample_with_probs.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Create data frame with probabilities
gaussian_sample_with_probs <- gaussian_sample %>% 
  ___(prob_from_cluster1 = 0.35 * ___(___, mean = 10, sd = 10),
         prob_from_cluster2 = 0.65 * dnorm(___, mean = 50, sd = 10),
         prob_cluster1 = ___/(prob_from_cluster1 + prob_from_cluster2),
         prob_cluster2 = ___/(prob_from_cluster1 + prob_from_cluster2)) %>%
  select(x, prob_cluster1, prob_cluster2) 
         
head(___)
Redigera och kör kod