확률 계산하기
이전 연습 문제에서는 확률이 주어졌을 때 평균과 비율을 추정하는 방법을 살펴봤어요. 이번 연습 문제의 목표는 평균과 비율이 알려져 있을 때 확률을 추정하는 거예요. 클러스터 1과 2의 평균이 각각 10과 50이라고 가정하고, 클러스터 1이 전체 집단의 35%를 차지한다고 가정하세요.
또한, 우리는 매개변수 추정에만 집중하므로 두 클러스터의 sd는 모두 10이라고 가정하세요. 작업 공간에는 gaussian_sample 데이터셋이 준비되어 있어요.
이 연습은 강의의 일부입니다
R로 배우는 Mixture Models
연습 안내
- 클러스터 1과 2의 확률 추정치가 포함된 새 데이터 프레임
gaussian_sample_with_probs를 생성하세요. 이를 위해prob_cluster1과prob_cluster2라는 두 개의 새 변수를 만드세요. 확률이 스케일되도록(정규화되도록) 처리하는 것을 잊지 마세요. gaussian_sample_with_probs의 처음 6개 관측치를 확인하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Create data frame with probabilities
gaussian_sample_with_probs <- gaussian_sample %>%
___(prob_from_cluster1 = 0.35 * ___(___, mean = 10, sd = 10),
prob_from_cluster2 = 0.65 * dnorm(___, mean = 50, sd = 10),
prob_cluster1 = ___/(prob_from_cluster1 + prob_from_cluster2),
prob_cluster2 = ___/(prob_from_cluster1 + prob_from_cluster2)) %>%
select(x, prob_cluster1, prob_cluster2)
head(___)