比較結果
我們已經看到,混合模型會為每個觀測值給出其屬於各叢集的機率。不過,如果你想把每個觀測值指派到機率最大的那個叢集,可以使用 flexmix 套件中的 clusters() 函式。
由於 mix_example 資料集是模擬產生的,我們其實擁有每個觀測值的真實標籤。這些真實標籤儲存在變數 assignment 中。本練習的目標是比較 clusters() 函式指派的標籤與真實標籤之間的差異。
本練習屬於課程
R 中的混合模型
練習說明
- 檢視
clusters()輸出的前 6 個元素。 - 檢視真實標籤的前 6 個元素。
- 使用
table()函式建立一個次數表,其中列為真實標籤,欄為預測標籤。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Explore the first assignments
___(___(fit_mix_example))
# Explore the first real labels
___(mix_example$___)
# Create frequency table
___(___, clusters(fit_mix_example))