Olasılıklar verildiğinde tahmin
Karma modeler için parametre tahmini kolay bir iş değildir. Ancak her kümeye ait olma olasılıkları verilirse, kümelerin ortalamalarını ve oranlarını (proportions) tahmin etmek o kadar zor değildir.
Bu egzersizde, iki Gaussian dağılım tarafından oluşturulmuş gaussian_sample_with_probs adlı bir veri kümesini kullanacaksın. Orijinal halinde yalnızca x sütunu vardır, ancak burada her küme için olasılıklar da verilmiştir (prob_cluster1 ve prob_cluster2). Amaç, parametreleri tahmin etmek ve ardından tahmin edilen karmayı görselleştirmektir.
Bu egzersiz, kursun bir parçasıdır
R ile Karışım Modelleri
Uygulamalı etkileşimli egzersiz
Bu egzersizi bu örnek kodu tamamlayarak deneyin.
# Estimation of the means
___ <- ___ %>%
summarise(mean_cluster1= sum(___*prob_cluster1)/sum(prob_cluster1),
mean_cluster2 = sum(x*___)/sum(___))
means_estimates
# Estimation of the proportions
props_estimates <- ___ %>%
summarise(props_cluster1 = ___(prob_cluster1),
props_cluster2 = 1 - ___)
props_estimates